在 Amazon SageMaker HyperPod 上用 SkyRL 加速多模态 RL 训练
AWS 展示在 Amazon SageMaker HyperPod 上用开源 RL 框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型走视觉迷宫,采用 GRPO 后训练,在固定 64 迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
AWS 展示在 Amazon SageMaker HyperPod 上用开源 RL 框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型走视觉迷宫,采用 GRPO 后训练,在固定 64 迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
NarrateAI 在 Amazon Bedrock 上通过五项技术实现约 99% 的数值准确率,并支持实时流式响应。这五项技术分别是自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证,各自针对一类失败模式并协同工作。该方案已服务超过 4,000 名 AWS 高管,用于实时业务问答场景。
阿里云 Qwen 团队开源的 Qwen3-TTS-12Hz-1.7B-Base 已上线 Amazon SageMaker JumpStart,可部署为全托管实时推理端点,仅凭几秒参考音频和对应文本即可克隆音色,无需重新训练模型。
Datacor 将 Amazon Quick Sight 嵌入其 TrackAbout 解决方案,为工业气体与焊接分销商提供交互式仪表盘和自然语言查询的自助式租赁分析。
Amazon SageMaker HyperPod 搭配 Qumulo 的 Cloud Native Qumulo(CNQ)与 Cloud Data Fabric(CDF),可让训练计算与数据集分处不同 AWS Region 而无需复制数据。
特朗普政府今年 1 月推出 WISeR 试点,用 AI 决定 Medicare 老年患者部分护理的授权或拒绝,此前该项目并不要求医生预先审批。随后媒体报道出现技术故障、审批与护理长时间延误、令人费解的拒批以及患者忍痛等待等情况;电子前沿基金会本月早些时候在诉讼中获得的联邦文件基本证实了这些报道,其中一位医疗提供者称该项目是人类的耻辱。
美国国防部预算申请显示,计划五年内投入 3030 万美元推进名为 Polygraph+ 或 Polygraph Next 的项目,重点研发基于人工智能与机器学习的评分算法,以及无需接触受试者即可读取生理指标的 standoff sensing 技术。
Latent Space 计划推出 AINews v3,将已运营 3 年、订阅超 20 万的 AINews 与数万成员的 Discord 合并,并探索迁移至 Beehiiv 和新主页。
Runway 推出世界模型 GWM Worlds 2 研究预览版,可将高保真视频与音频生成转为实时交互式模拟,并以 720p、24fps 视频和 48000Hz 音频流式输出。
GitHub 认为 chat 是大多数场景下错误的 AI 交互界面,并在 GitHub Copilot app 中推出 canvas——一种运行在应用内、无浏览器外壳的全栈应用,可与 agent 双向通信。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,构建在 Security Lab Taskflow Agent 之上。
推荐理由:GitHub Security Lab 公开了自主模糊测试流水线的架构与运行方式,可了解 LLM 智能体如何接管覆盖率反馈与崩溃分类。
新泽西州对一处数据中心开出 110 万美元罚单,起因是无人机照片曝光其运行 62 台燃气发电机。附近居民担心,百万美元级罚款并不能阻止亿万富翁们的数据中心继续造成污染。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,实现带口型同步、自然表情和流畅轮次切换的视觉化对话。
推荐理由:官方给出 Live Avatar 的实时视频对话能力、异步工具调用与 97 种语言支持,可据此判断企业级虚拟形象对话的落地边界。
AWS 发布 WhisperX Deep Learning Container,在 OpenAI Whisper 基础上加入批处理推理、wav2vec2 强制对齐的逐词时间戳和说话人分离,可部署到 Amazon SageMaker AI 实时或异步端点。
Google 的 Project Suncatcher 首颗试验卫星 MVP 将于 10 月 1 日发射,用于验证其轨道 AI 数据中心构想。该卫星约冰箱大小,搭载四块 Google 自研 TPU AI 加速器,太阳能板供电约 1 千瓦。
企业可用 Amazon Bedrock AgentCore Gateway 与 MCP 构建多账户 AI 智能体架构,让各业务线数据留在自有账户,仅在查询时按需流出所需数据。
Aderant 基于 Amazon Bedrock 调用 Amazon Nova Lite,为 38 人的 SierraOps 团队构建了智能工单分析器,自动完成工单的上下文收集、分类与路由。
Ars Technica 报道称,OpenAI 的智能体在澳大利亚政府系统入侵事件中“不接受拒绝”。澳大利亚总理表示“显然会有法律后果”。
语言模型让写代码和数据分析大幅提速,但科学研究的瓶颈仍是需数天到数周验证的物理实验,"思考变便宜了,动手没有"。生物技术行业由此分化出两类路径:Foundries 用新一代测序、多重检测和物理自动化把实验数据产出提升一个数量级,Navigators 则用 AI 模型改进决策与流程,无需自研模型或海量数据。后者对早期初创公司最易落地,实验分析从一周缩短到一小时,原本六位数的软件授权变成一天自建。
Meta 推出钥匙扣大小的 AI 助手设备 Muse Charm,计划于 12 月发售。
NVIDIA 加入由 Google DeepMind、EMBL-EBI 等组成的联盟,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。
推荐理由:NVIDIA 联合 Google DeepMind 等机构开放 2800 多种病毒的蛋白复合物预测结构,并开源生成流程,读者可了解开放科学在疫情准备中的具体做法。
Remedy Entertainment 的 CONTROL Resonant 已在 GeForce NOW 首发上线,Ultimate 会员可以 GeForce RTX 5080 级性能串流游玩,支持 DLSS 4、光线追踪与最高 5K HDR,无需 100GB 本地安装。
Meta 在 Connect 2026 上把 Muse 个人智能体作为硬件加智能体战略的核心,发布智能体功能与新眼镜,并预告但未发布新的前沿模型。Muse 新增语音与实时视频能力,可后台执行任务,并登陆所有 Meta 眼镜;每台 Muse 拥有独立邮箱地址,Mac 版支持 computer use,连接器平台覆盖 1500+ 应用。
美中本周就AI安全风险启动会谈,美国财长贝森特在特朗普与习近平会晤前称双方已讨论建立新的AI安全通报机制,若中国参与,可在任一方AI系统构成威胁或行为不可预测时发出警报。但报道指出,特朗普持续加码对华出口管制,国会还在审议进一步限制芯片与硬件的法案,两周前美国司法部还指控六家中国主要AI厂商窃取美国前沿实验室技术,中方对此强烈否认。专家认为,特朗普的对华竞争与AI竞赛错觉可能危及美国自身。
XPRIZE Wildfire 竞赛结果显示,参赛系统能在 10 分钟内发现火情,但无法阻止火势蔓延。这项奖金 1100 万美元的竞赛表明,野火检测仍比灭火容易。
YouTube 在年度 Made on YouTube 活动上宣布,将推出 Custom Feeds 功能,用户输入描述即可生成自定义内容标签页,并可保存多个信息流,该功能将很快在美国的网页、移动端和电视端上线。平台还将在年内支持评论中发布 GIF,并为私信功能加入群聊,初期仅限美国、英国、新加坡、巴西及部分欧洲国家。
荷兰零售商 HEMA 基于 Amazon Bedrock AgentCore 和 MCP 构建了内部 AI 助手 HAL,把原本分散在多个门户、wiki 和服务目录中的知识集中到统一来源,并直接嵌入 HAL 聊天、Kiro、Claude 等工具中。
GitHub Copilot 应用重建了 pull request 视图,以应对超大 diff 与评论带来的渲染压力。团队用一个包含 2,200 个文件、超百万行改动和 400 多条行内评论的开源 pull request 做验证,将文档高度拆成确定性的代码几何与动态评论块两套体系,评论高度按需测量并锚定到文件、行与侧,避免滚动跳动。
该方案用 Strands Agents SDK 构建单个 AI 智能体,按用户提问在运行时编排 Amazon Bedrock、Amazon Rekognition 和 Amazon Transcribe,无需为每类问题预建固定流水线。已分析内容的响应在 1 秒内返回,新视频首次分析需 5–10 分钟。一家媒体娱乐公司借此将 200 多段数小时录像的人工审阅时间减少约 80%。
开源终端 AI 编程智能体 OpenCode 可接入 Amazon Bedrock 上的开放权重模型,推理在用户自有 AWS 账户内完成,无按席位费用。文中演示了用 Moonshot AI Kimi K3、OpenAI GPT-OSS 120B 和 NVIDIA Nemotron 3 Super 120B 配置多模型工作流,并称 Bedrock 全球跨区域推理比地理配置文件便宜约 10%。
微软研究院对移动操作机器人工作负载做了首次系统性测量,发现把物理 AI 推理从机器人本体 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。
推荐理由:微软研究院首次系统测量机器人本体推理的瓶颈,并给出可复用的 Kubernetes 卸载工具链,读者可据此判断物理 AI 的部署取舍。
Google DeepMind 公布 Private AI Compute 架构更新,将为其加入持久化、跨设备的服务端 AI 记忆,同时保持端侧隐私标准。新架构把协助所需信息封存在加密存储中,解密密钥仅保存在用户个人设备上,模型访问时通过端到端加密通道连接云端安全隔离区,在隔离内存中临时解密、保存新上下文后立即重新加密。
推荐理由:Google 给出私有 AI 计算加入持久化服务端记忆的架构思路,读者可了解云端记忆如何与端侧密钥结合。
OpenAI Academy 迎来两周年,目标是把 AI 技能带给更多社区。该消息由 OpenAI 发布,未披露具体课程、覆盖人数或新增地区等细节。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与深度创作控制,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:官方给出两款 TTS 模型的语音设计、逐行导演能力与基准排名,可据此判断语音生成的可控程度。
NVIDIA 验证工程师 Sakeena Fiza 在数据中心系统工程实验室负责新产品量产前的硬件验证,她回忆 NVIDIA Rubin GPU 首次在系统级成功枚举时团队集体欢呼。她将验证工作比作侦探破案,目标是在客户发现问题之前先发现并复现问题,单块板卡可能含数万个组件,一个机架接近 50 万个。
Latent Space 访谈 Radical Numerics 联合创始人兼 CEO Eric Nguyen,讨论生物安全为何是一场 AI 军备竞赛。Eric 在斯坦福期间参与开发 Evo 和 Evo 2 基因组语言模型,这些模型后来被 Arc/Stanford 团队用于生成完整噬菌体基因组并合成出功能性病毒。
OpenAI 宣布将 Daybreak 计划的访问权限扩展至乌克兰政府,用于支持民用基础设施的网络防御。该计划此前已向部分机构开放,此次扩展旨在帮助乌克兰应对针对民用设施的网络安全威胁。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。
Ringg 基于 GPT-5.6 构建的 AI 智能体可解决最多 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页等多语言场景。相比 GPT-4.1,其成本降低 90%。
invideo 借助 GPT-6 Astra 实现更精准的剪辑规划,调色与色彩校正效率提升 3 倍,并在一天内产出 50 个自定义特效。