工坊日报 Research 2 篇

监管拔掉 Claude 的插头,企业 AI 开始拼交付能力

今天的 AI 新闻不是单点爆炸,而是一条更硬的主线:模型公司正在被迫从「能力展示」转向「可控交付」。OpenAI 拿出 1.5 亿美元做企业伙伴网络,Anthropic 因监管压力下线 Mythos 和 Fable,Braintrust 把 evals 和 CI 变成 Agent 交付流水线,工程圈则开始认真讨论推理系统、权限边界和最小能力原则。

华盛顿盯上 OpenAI,Agent 开始进入真刀真枪阶段

今天的主线很清楚:AI 已经不是单纯的模型竞赛,而是在进入“治理、工具、生产力重组”三线并发的阶段。华盛顿开始讨论 OpenAI 的国家级利益,Simon Willison 继续把 Agent 拉回真实软件工程,几篇新论文则在追问一个更硬的问题:Agent 到底能不能可靠地控制推理、重组知识工作、甚至自动做科学发现。