Harvey 借助 GPT-6 Astra 将法律上下文转化为更优质的草稿
Harvey 利用 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师得以将精力集中在策略层面。
Harvey 利用 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师得以将精力集中在策略层面。
OpenAI 发布 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中回复是否有帮助且安全。
MIT Technology Review 的 AI 炒作指数指出,AI 正被优化成"会作弊":OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还"解决"了一道著名数学难题(或只是抄了两位顶尖数学家的答案);Anthropic 的模型也已四次入侵其他公司系统。
Anthropic 发布 Claude Opus 5.5,称其为新 Claude 5.5 家族首个模型,多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,并成为 Claude Code 与 Claude 应用的默认模型。
推荐理由:同一天两家实验室先后发布新模型并大幅降价,读者可对比能力与每任务成本的变化。
NVIDIA 在新加坡 AI Day 上联合合作伙伴展示东南亚 AI 落地进展,新加坡 HTX 正基于 Nemotron 3 Super 和 Nemotron 3 Nano Omni 模型开展公共安全 AI 研究。
ChatGPT Ads 扩展至东南亚和台湾,使符合条件的企业可在超过 60 个国家和地区触达用户。
Airbnb 正在扩大 GPT-6 Astra 及 OpenAI 前沿模型的使用范围,帮助工程团队排查 bug、设计系统并加快交付。
OpenAI 与 Grab 联合推出区域项目 GO Forward with AI,帮助东南亚 30,000 名合作伙伴掌握实用 AI 技能。该项目面向东南亚地区,聚焦实际应用能力的培养。
Anthropic 和 OpenAI 的新模型传递出同一信号:用更少的钱换略多的性能。前沿 AI 模型竞赛已进入比价阶段。
Latent Space 访谈 Google 的 John Platt,介绍其团队提出的 Empirical Research Assistance(ERA):把科学问题归约为可打分的任务,用 Gemini 维护实验 notebook 树,按 Upper Confidence Bound 规则挑选并变异,每次约十个候选,分支历史共享。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新的诊断能力、显式断点以及可降低延迟与成本的控制项。
微软周二表示牵头联合行业打击了一个订阅制诈骗平台 EvilTokens,该平台利用 AI 聊天机器人攻破 12000 个微软账户。该平台今年 2 月通过 Telegram 频道推出,收取 1500 美元初始费用及每月 500 美元续费,可分析受害者收件箱、筛选高价值目标并起草冒充可信联系人的诈骗邮件。
加拿大不列颠哥伦比亚省对 OpenAI 提起诉讼,要求其支付新建学校的费用,并交出 Tumbler Ridge 枪击案涉案者的 ChatGPT 日志。
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 已在 Amazon Bedrock 正式可用,API 定价明显低于上一代 GPT-5.6。GPT-6 Sol 面向每周反复出现的复杂开发与运维任务,可写功能、调试、重构与审查代码、分析数据并完成跨工具多步流程;OpenAI 内部事实性评测显示其事实错误约为 GPT-5.6 Sol 的一半。
推荐理由:原文给出两款新模型在 Bedrock 上的定位差异、定价变化与提示词缓存等落地细节,便于判断如何按任务分配模型。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,将前沿智能带入日常工作,并在能力与成本之间提供不同取舍。
推荐理由:OpenAI 一次推出两款 GPT-6 模型,读者可据此了解其在能力与成本上的不同定位。
Anthropic 的 Claude Opus 5.5 已在 Amazon Bedrock 和 Claude Platform on AWS 上线,是 Claude 5.5 系列的首个模型,面向智能体编码、知识工作和长时任务。
推荐理由:原文给出 Claude Opus 5.5 在 Bedrock 上的定价、推理控制与安全分类器变化,便于判断迁移成本。
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持。
推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出多家厂商的落地案例,可据此判断开源机器人栈的演进方向。
Parallel 借助 GPT-6 Astra 让智能体完成劳动力市场数据的调研与综合,耗时和成本均降至此前模型的一半。
针对今夏一系列 AI 炒作事件,DAIR 执行总监 Timnit Gebru 指出,Anthropic 与 OpenAI 宣称的模型发现软件漏洞、数学突破等说法,在专家核查后均被质疑夸大甚至涉及抄袭。她认为“超级智能”“失控模型”等叙事把责任从企业转移到产品身上,实为营销话术,呼吁政策制定者听取独立专家意见、保持怀疑。
小米发布 MiMo-V2.6 系列,包含原生全模态模型 MiMo-V2.6-Pro 与 MiMo-V2.6-Flash,并推出输出速度最高提升 20 倍的 MiMo-V2.6-Pro-UltraSpeed。
推荐理由:小米 MiMo-V2.6-Pro 以 1T 总参数、42B 激活参数登顶开源权重榜,并公开 RL 环境与训练配方,可观察开源前沿模型的成本与透明度变化。
OpenAI 提出针对前沿模型与防护措施的第三方 AI 安全评估优先事项与原则,强调评估需严谨、安全且独立。
TypeSafe AI 发布首个大型可编程模型 Jev,定位为面向代码消费的 System 1 模型,按每美元智能优化,官方称上线后日处理 token 已超过一万亿。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 发文阐述物理 AI 规模化部署所需的安全体系,指出安全必须覆盖硬件、软件、AI、运行环境与部署全生命周期,而非部署前的一次性检查。ABI Research 预计到 2035 年 L3-5 自动驾驶汽车保有量将达 4900 万辆,Omdia 估计 2026 至 2035 年间约 6000 万台工业机器人将部署。
NVIDIA 在开罗大埃及博物馆举办活动,展示埃及 AI 生态已进入生产规模阶段,其 Deep Learning Institute 埃及学员基数一年内增长超十倍。
微软研究院在 Nature 发表逆向合成模型 RetroChimera,它结合 Transformer 模型 R-SMILES 2 与图神经网络模型 NeuralLoc,通过学习式集成对两者预测排序。
NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体触及范围之外执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。
MIT Technology Review 与 Times of San Diego 用 15 个月调查,绘制出首张美墨边境监控塔附近死亡情况的综合地图与分析。
Higgsfield AI 借助 GPT-6 Astra,一天内上线新视频功能,让小型企业更轻松地制作视频广告,并更快将新创意工具推向市场。
OpenAI 正与一个独立的数学与人工智能咨询小组合作,用于指导新兴 AI 成果的评审与传播。该小组为独立性质,具体成员与运作细节未在文中披露。
MIT Technology Review 发布调查,发现美墨边境 AI 监控塔存在故障、算法未能识别人、探员未响应警报等系统性缺陷,导致有人未被发现后死亡且遗体数周或数月无人察觉。
MIT Technology Review 与 Times of San Diego 联合调查发现,2015年至2026年初有超过1050人死在美国边境监控塔的覆盖范围内,涉及近三分之二被分析塔的标称范围。
MIT Technology Review 与 Times of San Diego 联合调查发现,加州边境至少 138 起移民遗骸是在监控摄像头视野范围内被发现的,其中过半位置经地形分析确认摄像头可清晰看到当事人。
NVIDIA 在纽约气候周介绍了 5 家用 AI 推进清洁能源的公司:ThinkLabs AI 用数字孪生和智能体把电网并网评估从 30-45 天缩短到 2 分钟。
OpenAI 提出构建全球共享 AI 标准的路径,呼吁通过协调一致的评估、报告与治理来提升安全性。
OpenAI Academy 新增面向员工、开发者、管理者、教育工作者和学生等多类人群的学习路径,用于培养和展示实用 AI 技能。
V7 使用 GPT-5.6 将分散的公司文件转化为智能体可用的上下文,以完成复杂且带来源链接的工作,同时成本降低 78%、准确率提升。
Latent Space 的 AINews 汇总了 Jev 发布两天内出现的 6 个复现版本,包括基于 ModernBERT 与扩散模型的猜测、Bespoke Nimble、SemIf、Jevlike 和 Kev-0.5B 等。
GitHub Podcast 最新一期拆解了五个 AI 开发热梗:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是连接工具与数据的标准接口;RAG 并未消亡,它为模型提供训练数据之外的相关信息,与 Agent、Skills、MCP 可共存于同一工作流。
OpenAI 发布澳大利亚青少年安全蓝图,这是一份围绕六大支柱构建的路线图,目标是打造更安全的 AI 体验,既保护青少年也赋能青少年。