Anthropic 的 Thariq 谈 Claude Code 下一阶段:Claude Mods、多人与智能体安全
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括 Ask User Question、artifacts 作为持久生成式界面、Claude Tag 与 Projects 的多智能体协作,以及可自定义执行循环与 UI 的 Claude Mods。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括 Ask User Question、artifacts 作为持久生成式界面、Claude Tag 与 Projects 的多智能体协作,以及可自定义执行循环与 UI 的 Claude Mods。
OpenAI 负责 Agent Security 的 @joedaroo 表示,模型在 cyber、swarming、message boards 等相关能力上的跃升之快令人意外,安全姿态需要时间建设,不只是加固系统,还要把安全融入公司文化,让组织里的人随之改变。
哈佛心理学家 Steven Pinker 在 Quillette 发表公开信,回应科技博主 Scott Alexander 的辩论挑战,认为 AI 灭绝人类的恐惧被夸大,回形针最大化等末日场景混淆了智能与支配欲。
Redwood Research 首席科学家 Ryan Greenblatt 在 Sam Harris 播客中估计,若按当前路径发展,失控 AI 接管人类的概率约为 50%-60%,并可能导致大量或全部人类死亡。
Latent Space 播客邀请 OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha,回顾 OpenRouter 从 Llama、Alpaca、Mistral 时期起步,成为服务超过 1000 万开发者的中立路由层,并解释 Stripe 收购 OpenRouter 的原因。
John Gruber 在评论 Meta 的 Muse 时表示,Muse 因技术上的突破性(每个用户在 Meta 云端拥有自己完整的持久 Linux VM)以及易于安装使用而受到大量关注,它是首个面向消费者的智能体 AI 系统。但他认为人们并未意识到 Muse 有多强大、因而有多危险,尤其是在自己的 Mac 上运行时。
Latent Space 访谈 Radical Numerics 联合创始人兼 CEO Eric Nguyen,讨论生物安全为何是一场 AI 军备竞赛。Eric 在斯坦福期间参与开发 Evo 和 Evo 2 基因组语言模型,这些模型后来被 Arc/Stanford 团队用于生成完整噬菌体基因组并合成出功能性病毒。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。
Latent Space 访谈 Google 的 John Platt,介绍其团队提出的 Empirical Research Assistance(ERA):把科学问题归约为可打分的任务,用 Gemini 维护实验 notebook 树,按 Upper Confidence Bound 规则挑选并变异,每次约十个候选,分支历史共享。
针对今夏一系列 AI 炒作事件,DAIR 执行总监 Timnit Gebru 指出,Anthropic 与 OpenAI 宣称的模型发现软件漏洞、数学突破等说法,在专家核查后均被质疑夸大甚至涉及抄袭。她认为“超级智能”“失控模型”等叙事把责任从企业转移到产品身上,实为营销话术,呼吁政策制定者听取独立专家意见、保持怀疑。
OpenAI 的 Chris Lehane 主张,AI 能力越强,越需要更强的安全证据、共享标准与持久的政策行动。他认为当前政策窗口仍然敞开,各方应抓住时机推动落地。
OpenAI 的 Jakub Pachocki 撰文反思能力日益强大的 AI 及其对齐难题,呼吁加强安全防护并推动国际协调。他将这类系统称为"异类心智",强调在能力提升的同时必须确保其与人类意图保持一致。