- 2026年8月29日 300项任务验证视觉推理,检索快12.4倍 日报
- 2026年8月28日 扩散对齐19项居首,记忆引用仅7.9% 日报
- 2026年8月26日 可执行rubric延迟最多降至1/320 日报
- 2026年8月25日 部署闭环加速6.98倍,改计划提13.3点 日报
- 2026年8月24日 开放流视频编辑,VLM压至2.7比特 日报
- 2026年8月21日 27B全参微调压至推理级显存 日报
- 2026年8月18日 3D世界构建成功率不足60% 日报
- 2026年8月16日 学习工作流让设计Agent从54.99升至67.39 日报
- 2026年8月15日 13项技能把捏造检出率推至92% 日报
- 2026年8月10日 WorldTrace让场景召回提升19.5% 日报
- 2026年8月6日 用户改代码让Agent成功率降7.7个百分点 日报
- 2026年8月4日 CADENA逐步验形,MoE失衡超5倍 日报
- 2026年8月3日 VideoCoCo将VBench提至77.88 日报
- 2026年8月2日 AI4AI升至71.21%,AskChem索引240万论断 日报
- 2026年8月1日 TurboVLA以0.9GB显存跑到32Hz 日报
- 2026年7月30日 Skill-SP让开放任务可验证 日报
- 2026年7月29日 JarvisHub保存版本,OmniVAE前移音画对齐 日报
- 2026年7月28日 因子化推断达85.5%,裁剪耗时降至2.5毫秒 日报
- 2026年7月23日 滤波修正扩散采样,单相机重建人景 日报
- 2026年7月10日 RL训到图像生成,Gemma 4开源 日报
- 2026年7月8日 数字人分辨率翻倍,延迟守住200ms 日报
- 2026年7月7日 潜空间打分把视频生成压到1-4步 日报
- 2026年7月5日 记忆让agent谄媚,视觉推理93.2% 日报
- 2026年7月4日 自适应解码4.2倍,联合训练快10倍 日报
- 2026年7月3日 35B agent对标1T,异步滞后被高估 日报
- 2026年7月1日 1.6小时长任务agent只做完两成 日报
- 2026年6月29日 视频世界模型卡24%,越狱只压几个头 日报
- 2026年6月28日 ViQ让多模态训练提速20-70% 日报
- 2026年6月27日 ImageNet-FID与文生图能力负相关 日报
- 2026年6月21日 榜单分预测不了部署,机械臂自迭代99% 日报
- 2026年6月20日 7B视频agent反超72B模型 日报
- 2026年6月17日 1.5B模型预测事件赢过Sonnet3.5 日报
- 2026年6月16日 code agent最强61.1%,VLA推理快6倍 日报
- 2026年6月11日 V4把KV压到13.5%,视频记忆快10倍 日报
- 2026年6月10日 视频模型栽在组合编辑,MoE败在路由 日报
- 2026年6月8日 dots.tts首包54ms,SWE自进化破50% 日报
- 2026年6月7日 流式传递让多agent更准,1/6高斯更清晰 日报
- 2026年6月4日 4B agent几千条轨迹追平闭源CUA 日报
- 2026年6月2日 MoE安全集中在少数专家、独占批提速42% 日报
- 2026年6月1日 0.5概率即逐字背诵,倒放视频测因果 日报
- 2026年5月30日 Agent开始学会自己变强,也学会少用工具 日报
- 2026年5月27日 我们一直在用错的尺子量模型的『心里话』 日报
- 2026年5月24日 DeltaNet拆双门,Maestro压GPT-5 日报
- 2026年5月21日 双流MoE统一多模态,换装视频30倍提速 日报
- 2026年5月20日 LRM早停换判据省26%token 日报
- 2026年5月15日 δ-mem用8×8矩阵换长上下文 日报
- 2026年5月8日 T²PO稳多轮RL+视频缓存提速6倍 日报
- 2026年5月4日 ViT改用LM目标预训练替代CLIP 日报
- 2026年5月3日 FID当loss一步生成达0.72 日报
- 2026年4月30日 RL给视频生成补3D一致性 日报
- 2026年4月28日 ProEval省8-65倍评测样本 日报
- 2026年4月24日 校准critic让推理涨18点 日报
- 2026年4月23日 305M检索器指令遵循涨45% 日报
- 2026年4月21日 3B拒答追平R1,B矩阵是LoRA瓶颈 日报
- 2026年4月17日 大模型更抗谣言却更易被噪声带跑 日报
- 2026年4月15日 PRM标注成本降两个数量级,dLLM幻觉错法不同 日报
- 2026年4月12日 打乱音视频练推理,6B模型超GPT-4o 日报
- 2026年4月10日 Entropy在骗你,隐式推理止于7步 日报
- 2026年4月9日 单GPU训120B·视频评测四成靠猜 日报
- 2026年4月6日 32B硬件代码开源进第一梯队,Agent难题仅23% 日报
- 2026年4月4日 单神经元记住实体,套路复用提效19% 日报
- 2026年4月3日 极简Agent打平MCP,代码推理边写边想 日报
- 2026年4月2日 配比成本降35倍,显眼词劫持推理38倍 日报
- 2026年3月29日 Mistral自研TTS、扩散LLM加速4.7倍 日报
- 2026年3月25日 PDE替掉attention误差低2倍,局部RL省3/4算力 日报
- 2026年3月24日 Seed1.8把Agent做进基座,语言训练让视觉退化 日报
- 2026年3月23日 12B超GPT-4,蒸馏后学生反超教师 日报
- 2026年3月19日 开源搜索Agent逆袭,Agent Skills神话破灭 日报
- 2026年3月18日 70万对论文蒸馏品味,零空间暴露盲区 日报
- 2026年3月17日 专家推理结构做CoT,新类发现+13% 日报
- 2026年3月14日 编码答案而非问题,embedding涨9% 日报
- 2026年3月11日 4步超100步基线,跳层省18%算力 日报
- 2026年3月10日 12k样本赢金融SOTA,CUDA优化快35% 日报
- 2026年3月9日 去掉CLIP的VLM更强,prefill加速28倍 日报
- 2026年3月3日 谱条件统一μP缩放,数据筛选也泄露隐私 日报
- 2026年3月1日 Latent推理靠的不是推理 日报
- 2026年2月28日 三模态从零训练,Agent RL稳定性破局 日报
- 2026年2月27日 TTT就是线性注意力,Terminal Agent数据配方开源 日报
- 2026年2月24日 74%的agent协调可能是白费的 日报
- 2026年2月23日 模型压缩的几何直觉:折叠比剪枝更优 日报
- 2026年2月20日 示例图对替代prompt,Agent筛信息暗藏偏心 日报
- 2026年2月19日 频谱衰减让W4A4量化回升7%精度 日报
- 2026年2月18日 二进制token让图像生成快30倍,RL训练也在学会反思 日报
- 2026年2月13日 AI数学研究agent解开真实开放问题,世界模型扎堆涌现 日报
- 2026年2月8日 用扩散模型做投机解码,推理加速6倍 日报
- 2026年2月7日 百度发布万亿参数统一多模态模型ERNIE 5.0 日报
- 2026年2月6日 只保留256个token就能逼近全量注意力性能 日报