- 2026年3月1日 Latent推理靠的不是推理 日报
- 2026年2月28日 三模态从零训练,Agent RL稳定性破局 日报
- 2026年2月27日 TTT就是线性注意力,Terminal Agent数据配方开源 日报
- 2026年2月26日 Agent红队11种失败模式,step级路由降本700倍 日报
- 2026年2月25日 token概率直接当reward,零样本达0.95相关性 日报
- 2026年2月24日 74%的agent协调可能是白费的 日报
- 2026年2月22日 DiT动态patch快3倍,Mamba减法逼近softmax 日报
- 2026年2月21日 Agent从80分涨到90分,失败模式没变 日报
- 2026年2月19日 频谱衰减让W4A4量化回升7%精度 日报
- 2026年2月17日 Web Agent在线RL突破70%,奖励模型换个方向思考就行 日报
- 2026年2月16日 医疗AI、科学Agent、机器人VLA:垂直领域正在成为AI的主战场 日报
- 2026年2月15日 RL训练数据不够用?把简单题拼成难题就行 日报
- 2026年2月14日 11B参数跑出frontier级Agent智能,Coding Agent评测该换赛道了 日报
- 2026年2月13日 AI数学研究agent解开真实开放问题,世界模型扎堆涌现 日报
- 2026年2月11日 Agent跑久了上下文会「腐烂」,但好的上下文管理策略能大幅挽回性能 日报
- 2026年2月10日 LinkedIn把LLM搜索排序做到了上线水平 日报
- 2026年2月9日 医疗LLM不该只答题,应该像医生一样主动问诊 日报
- 2026年2月8日 用扩散模型做投机解码,推理加速6倍 日报
- 2026年2月7日 百度发布万亿参数统一多模态模型ERNIE 5.0 日报
- 2026年2月3日 预训练数据配比不用训练就能搜到最优解 日报
- 2026年2月2日 RLVR训练数据不够用?从互联网文本里无限合成就行 日报