模型后训练别一上来就凭感觉打分:奖励顺序比阶段数量更重要
工具还在跑,AI为什么还能继续说?看懂多模态异步事件流
vLLM为了新GPU拆掉旧抽象,为什么还要再造一套可移植层
AI出海先别只问模型强不强,云地域正在变成产品边界
本地模型不是断网版云模型:Agent任务路由怎么分才不泄密
用户纠正一次,模型下次还是会错:Shopify怎样把失败写进权重
百万行PR也能顺滑滚动,GitHub靠的不是再加一层虚拟列表
GGUF能在Transformers里直接跑了,本地模型终于不用二选一
Agent会话不是沙箱:微软这次把两个最容易混的隔离轴拆开了
Agent有对话记录就不怕重启吗?用持久工作区分清三种状态
最新文章
校招求职经历分享
05/28
职场一年 | 在结束学生时代的这一年里
05/28

