(2026-08-16) 当药企突然开始为纯软件买单:Chai 正在把生物分子做成“分子的 CAD” 过去四年制药巨头只买绑定临床的管线资产,今年却在 72 小时内疯抢 AI 软件授权。从 AlphaFold 结构预测到 Chai 的全原子 De Novo 设计,生物学正在迎来将经验科学转化为精密工程的 CAD 时刻。
(2026-08-16) 在语言的熵隙里掷骰子:Anthropic 文本水印的数学优雅与现实尴尬 Claude 文本水印把统计指纹藏进了同义词选择的微小冗余里,在数学上做到了对体验的极致克制;但在开源对抗与洗稿黑产面前,它注定只是一张给正规军佩戴的合规出厂标。
(2026-08-16) 编程智能体的“急诊室交接班”:从 Pi 的 Compaction 机制看上下文治理与缓存代价 上下文压缩从来不是省 Token 的小修小补,而是智能体在注意力衰减、KV Cache 前缀失效与会话主权之间的一场精密工程妥协。
(2026-08-16) 大模型不是没记住,而是想不起:Google 揭开前沿 LLM 事实性瓶颈的真实隐相 Google Research 实证表明:前沿大模型事实编码率已达 98% 饱和,事实性错误主要源于单步生成无法有效寻址的“钥匙丢失”。思考计算的物理本质是脑内自发检索器。
(2026-08-16) 别再死磕模型微调了:美团 AutoDesign 用 54 次元脚手架迭代,给长程设计智能体立了新标杆 冻结底层大模型权重,通过双层嵌套循环与元脚手架优化,美团 AutoDesign 在学术海报基准上以 +7.45 分超越商业闭源的 Claude Design。长程多模态智能体的真正战场,是包在模型外面的可进化工程系统。