跳到正文

#Agent

今日 0 条
9月29日周二
  1. AWS Machine Learning Blog60

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,可据此评估长任务智能体的成本与延迟取舍。

9月28日周一
9月26日周六
  1. GitHub Blog · AI & ML38

    GitHub Copilot 入门:如何用 canvases 构建自定义工作流

    GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义的双向界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单、仪表盘等界面,无需编写代码或手动设计。canvas 支持用户与 agent 同时操作并即时同步状态,创建后可保存为项目共享或个人扩展,社区已在 Awesome Copilot 分享现成模板。

9月25日周五
9月24日周四
  1. AWS Machine Learning Blog50

    基于 AWS 的智能体对话式视频智能方案

    该方案用 Strands Agents SDK 构建单个 AI 智能体,按用户提问在运行时编排 Amazon Bedrock、Amazon Rekognition 和 Amazon Transcribe,无需为每类问题预建固定流水线。已分析内容的响应在 1 秒内返回,新视频首次分析需 5–10 分钟。一家媒体娱乐公司借此将 200 多段数小时录像的人工审阅时间减少约 80%。

  2. AWS Machine Learning Blog34

    如何在 Amazon Bedrock 上用开放权重模型运行 AI 编程智能体 OpenCode

    开源终端 AI 编程智能体 OpenCode 可接入 Amazon Bedrock 上的开放权重模型,推理在用户自有 AWS 账户内完成,无按席位费用。文中演示了用 Moonshot AI Kimi K3、OpenAI GPT-OSS 120B 和 NVIDIA Nemotron 3 Super 120B 配置多模型工作流,并称 Bedrock 全球跨区域推理比地理配置文件便宜约 10%。

9月23日周三
  1. AWS Machine Learning Blog74

    GPT-6 Sol 与 GPT-6 Luna 在 Amazon Bedrock 正式可用

    OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 已在 Amazon Bedrock 正式可用,API 定价明显低于上一代 GPT-5.6。GPT-6 Sol 面向每周反复出现的复杂开发与运维任务,可写功能、调试、重构与审查代码、分析数据并完成跨工具多步流程;OpenAI 内部事实性评测显示其事实错误约为 GPT-5.6 Sol 的一半。

    推荐理由:原文给出两款新模型在 Bedrock 上的定位差异、定价变化与提示词缓存等落地细节,便于判断如何按任务分配模型。

9月22日周二
9月21日周一
9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解五大 AI 热梗:该不该读 AI 代码、RAG 已死、Skills 是否杀死 MCP

    GitHub Podcast 最新一期拆解了五个 AI 开发热梗:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是连接工具与数据的标准接口;RAG 并未消亡,它为模型提供训练数据之外的相关信息,与 Agent、Skills、MCP 可共存于同一工作流。

9月17日周四
  1. GitHub Blog · AI & ML82

    GitHub 用 Copilot 把 Copilot 运行时迁移到 Rust

    GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,AI 智能体写了其中大部分代码,跨 128 个 PR 增量合入 main。

    推荐理由:作者以亲历者身份给出把 80 万行运行时迁到 Rust 的完整工程数据,可迁移到大规模智能体协作开发。

9月16日周三
9月14日周一
9月12日周六
9月11日周五
  1. GitHub Blog · AI & ML38

    GitHub Copilot 应用新手指南:使用 diff、终端和浏览器面板

    GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让用户无需切换编辑器、终端和浏览器即可完成审查、运行和预览 AI 生成代码的完整流程。diff 面板以绿色和红色高亮显示代码增删改,终端面板支持运行项目命令并可通过 Run 按钮配置脚本,浏览器面板的 Pick & Polish 工具可选中页面元素并让智能体调整。

9月10日周四
  1. OpenAI News62

    OpenAI 推出面向金融服务的 ChatGPT

    OpenAI 推出面向金融服务的 ChatGPT,内置金融数据并接入 GPT-6 Astra,用于研究、建模和生成可直接交付客户的材料。

    推荐理由:官方给出金融场景的定位与能力组合,读者可据此判断 ChatGPT 在专业工作流中的切入点。

  2. OpenAI News62

    OpenAI 发布 Agents API

    OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务提供编排、长时运行会话和工具调用能力。

    推荐理由:OpenAI 官方发布托管式 Agents API,读者可据此了解云端智能体的编排与长时会话能力入口。

9月9日周三
9月6日周日
9月5日周六
  1. GitHub Blog · AI & ML71

    GitHub 发布 Project HydraFusion:用多模型编排实现前沿级编码质量

    GitHub 推出研究预览版 Project HydraFusion,在 GitHub Copilot CLI 中通过 /experimental 启用,可在多个提供商的模型间做运行时编排,自动选择 Single、Cascade、Critique 三种执行模式来平衡质量、成本与延迟。

    推荐理由:GitHub 官方给出 HydraFusion 的三种编排模式与三个编码基准的成本质量对比,可据此判断多模型编排在真实编码任务中的取舍。

9月4日周五
  1. GitHub Blog · AI & ML58

    GitHub Copilot 应用入门:如何同时运行多个 Agent

    GitHub Copilot 应用支持同时运行多个 Agent 会话,每个会话运行在独立的 Git worktree 上,互不干扰,可并行推进不同任务。每个会话保留各自的上下文,用户可在会话视图里查看标题和任务进度,并随时切换而不必重新说明背景。文中以 tailspin-toys 仓库为例,演示同时让 Copilot 添加 funded sort、做无障碍审查和跑测试三个任务。

9月3日周四
  1. Google DeepMind66

    Google DeepMind 推出 Fairwind Program,向政府与企业开放 Gemini 3.8 Flash Cyber

    Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型访问权限。

    推荐理由:原文给出受限访问计划的能力组合与准入条件,读者可据此判断前沿网络防御能力的开放节奏。