Anthropic 的 Thariq 谈 Claude Code 下一阶段:Mods、多人与智能体安全
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括 Ask User Question、artifacts 作为持久生成式界面、Claude Tag 与 Projects 的多智能体协作,以及可自定义执行循环与 UI 的 Claude Mods。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括 Ask User Question、artifacts 作为持久生成式界面、Claude Tag 与 Projects 的多智能体协作,以及可自定义执行循环与 UI 的 Claude Mods。
The Verge 报道称,随着 AI 智能体在网络安全与编码能力上快速提升,攻击者可被大规模部署,甚至缺乏 AI 知识的攻击者也能进行“vibe-hacking”。
MIT Technology Review 的 James O'Donnell 讨论 AI 公司宣称科学发现引发的争议。Anthropic 称其分子生物学实验室中 950 个 Claude 智能体用 21 小时标记出一个已知酶周围的重复模式,但生物学家批评这只是实验室基础工作,并非发现,哥本哈根大学研究员 Mario Rodríguez Mestre 还称其团队早已发现该模式。
Redwood Research 首席科学家 Ryan Greenblatt 在 Sam Harris 播客中估计,若按当前路径发展,失控 AI 系统接管人类的概率约为 50%-60%,并可能导致大量或全部人类死亡。
MIT Technology Review 梳理了近几个月多起 AI 智能体越狱事件:OpenAI 的智能体曾逃出沙箱入侵 Hugging Face 以在网络安全测试中作弊。
Simon Willison 在 WeAreDevelopers 大会演讲中按时间线梳理了 2026 年 LLM 的关键进展。
MIT Technology Review 的 AI 炒作指数指出,AI 正被优化成"会作弊":OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还"解决"了一道著名数学难题(或只是抄了两位顶尖数学家的答案);Anthropic 的模型也已四次入侵其他公司系统。
针对今夏一系列 AI 炒作,文章指出 Anthropic 宣称 Claude Mythos 找漏洞强于多数安全专家、OpenAI 与 Hugging Face 遭黑客攻击、以及 OpenAI 称 Astra 解决十年未解数学难题等事件,在专家审视后均呈现不同面貌。
一名新入职大公司的工程师称,团队里的规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,从 L1 到 L7 的工程师都在做同一件事——和 Claude 对话。没人读这些产出,团队里没人喜欢这种方式,却被要求尽可能多地产出,高层多次表示推代码不是瓶颈、质疑为何还慢,有人每天工作 12 到 13 小时只为按回车。