2026-W40 · 31 篇报道

本周 AI 要闻: 2026年9月28日 – 2026年10月4日

按原始来源发布日期汇总本周重要动态。每条都附有详细报道和原始来源。

期号日期: ·周: 2026年9月28日 – 2026年10月4日

本周变化

三项关键变化

  1. OpenAI 开始推出常驻代理 Dots

    变化
    OpenAI 正向符合条件地区的 Pro、Business Premium 和 Enterprise 用户推出基于 GPT-6 Astra 的 Dots;代理可连接 4,000 多个应用,而主动研究功能使用只读工具。
    实际意义
    Dots 面向跨连接应用持续处理任务和后台研究而设计。
    查看报道 ↗
  2. OpenAI 发布 GPT-6.1 Sol

    变化
    OpenAI 发布了 GPT-6.1 Sol,并称该模型在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,而每项任务的成本约为其五分之一。
    实际意义
    开发者可针对编程和专业工作流程进行评估,并用自己的任务比较效果与成本。
    查看报道 ↗
  3. OpenAI Agents API 推出计算机使用工具

    变化
    该工具允许代理在 OpenAI 托管的环境中操作网站,并要求用户在代理访问每个新的网站源之前批准。
    实际意义
    开发者应限制代理访问无法执行重大操作的资源:API 本身不会阻止此类操作,而且允许访问网站并不代表批准每一项操作。
    查看报道 ↗

模型

6

Anthropic:GLM-5.3 展现自主漏洞利用能力

Anthropic 的研究记录了 GLM-5.3 在漏洞利用任务中的表现,以及安全限制可能被绕过的方式。

研究中的测试结果说明,防御团队需要重新评估自动化漏洞发现和利用带来的风险。具体能力与成功率应结合 Anthropic 的测试条件理解。

查看报道 ↗原始来源 ↗

Anthropic 发布 Claude Sonnet 5.5:响应速度与成本优化详解

Anthropic 推出 Claude Sonnet 5.5,聚焦日常办公效能。本文剖析其性能指标及对自动化任务的实际应用价值。

性能与成本的双重优化直接决定了 AI 自动化的投入产出比。鉴于性能数据由厂商提供,建议团队在全量切换前,先行基于自身业务负载进行对比评测,以确保符合预期。

查看报道 ↗原始来源 ↗

产品

3

OpenAI 发布 AI 智能体 Dots,由 GPT-6 Astra 驱动

OpenAI 推出 Dots 智能体,支持连接 4000 多款应用程序,并能在后台进行主动研究以协助用户处理复杂任务。

Dots 的推出标志着人工智能从对话式助手向自主型智能体的转型。通过将繁琐的跨平台任务委托给可自主运行的智能体,用户可以显著降低手动操作的工作负载,提升办公效率。

查看报道 ↗原始来源 ↗

实际应用

7

Salesforce介绍Agentforce在客户服务中的应用案例

Salesforce介绍企业使用AI代理的案例,包括Canada Goose报告的自动处理比例,以及AT&T如何为门店顾问提供客户背景信息。

这些案例显示,客服自动化也可能涉及员工准备和模型行为控制。结果由企业自行报告,材料未提供方法或基线数据,也没有独立核实这些结果。

查看报道 ↗原始来源 ↗

巴克莱扩大Claude应用,预计Claude Code采用率到2027年继续上升

巴克莱正在扩大Claude在银行业务中的应用。Anthropic介绍了员工助手和邮件处理流程;巴克莱预计,到2027年,大多数软件工程师将使用Claude Code。

这项扩展展示了Claude在银行软件开发和内部运营中的应用。员工助手和邮件处理数据由Anthropic提供;Claude Code相关数字是巴克莱的预期,并非已经实现的结果。

查看报道 ↗原始来源 ↗

Salesforce 发布 Koa CRM 专用推理模型

Salesforce 推出了基于 NVIDIA Nemotron 3 架构的 Koa 模型,并发布了 Enterprise AI Harness 框架以加强企业级 AI 的治理与部署。

该方案为企业提供了可治理、可信赖的 AI 工具链,使企业能够安全地集成专用模型并控制人工智能在业务流程中的执行逻辑。

查看报道 ↗原始来源 ↗

Meta 为小企业扩展 Muse AI 代理功能

Meta 为 Muse AI 代理引入了新技能和连接器,助力小企业主自动化管理日常业务。

通过将散乱的行政与营销任务整合至单一的 AI 代理中,Meta 旨在帮助资源有限的小企业提高运营效率,减少繁琐的手动处理工作。

查看报道 ↗原始来源 ↗

开发者

15

GitHub向五种套餐开放Copilot代码审查API请求,Balanced成为默认级别

Copilot Pro、Pro+、Max、Business和Enterprise用户可通过受支持的REST和GraphQL API请求代码审查,并可选择为每次请求设置审查力度。

这些套餐的团队可以通过受支持的API,从自己的脚本、工作流和内部工具中请求代码审查。团队可以逐次设置审查力度;Balanced默认值不会覆盖明确选择的Lite设置。

查看报道 ↗原始来源 ↗

GitHub将于2026年10月2日起弃用Copilot中的四款模型

调整涉及所有Copilot功能。GitHub列出三款替代模型;Copilot Enterprise管理员可能需要通过模型策略启用相应访问权限。

此次调整会影响所有Copilot功能中的模型选择。用户应检查工作流和集成;Enterprise管理员可能需要在设置中确认替代模型的访问权限。

查看报道 ↗原始来源 ↗

微软在Microsoft Foundry推出三款MAI语音模型

Microsoft Foundry现已提供支持60种语言的流式转写和两款语音合成模型;微软也公布了价格,并列出计划接入的平台。

开发者可将能在数百毫秒内返回首批部分转写的流式识别,与两款语音合成模型搭配使用。按音频小时和每百万字符计价的价格已经公布,可用于估算成本。微软公布的性能数据尚未在此得到独立验证。

查看报道 ↗原始来源 ↗

Hugging Face 推出 Open TTS Leaderboard,评测语音模型

Hugging Face 的 Open TTS Leaderboard 用 WER/CER、RTFx、TTFA 和说话人相似度比较开源 TTS 模型。客观分数补充而非取代人类偏好排名。

对开发者来说,这是一种比持续数周收集投票更快、更易复现的模型比较方式。但 WER 和说话人相似度只是代理指标,不能衡量自然度、表现力或听者偏好,榜单也不取代人类排名。

查看报道 ↗原始来源 ↗

OpenAI:GPT-6 Astra可用Ultrafast,速率限制较低

OpenAI称Ultrafast是其API中速度最快的服务档位。所有API用户均可将其用于GPT-6 Astra,但速率限制较低;GPT-5.6 Sol提供预览访问。

开发者可以为GPT-6 Astra选择OpenAI API中速度最快的服务档位,同时权衡较高成本、较低速率限制和区域处理约束。

查看报道 ↗原始来源 ↗

Grok 4.7 现已上线 Amazon Bedrock

AWS 宣布将 Grok 4.7 引入 Amazon Bedrock 平台,提供 50 万 token 的上下文窗口及可调节的推理深度。

通过提供高度灵活的推理配置和大规模上下文处理能力,该模型能够有效提升企业在复杂任务中的自动化执行效率。

查看报道 ↗原始来源 ↗

AWS 将 Claude Sonnet 5.5 引入 Amazon Bedrock

AWS 宣布在 Amazon Bedrock 中提供 Claude Sonnet 5.5,旨在通过更高的处理效率降低编程与文档处理任务的成本。

引入更高性价比的模型有助于企业降低云端 AI 应用的运营开销。对于需要执行代码生成与自动化分析的开发者而言,此举能够提升工作流程的经济性。

查看报道 ↗原始来源 ↗

NVIDIA宣布推出Open Agent Safety Platform

NVIDIA宣布推出开放软件平台及参考系统设计,旨在从测试到部署加强对AI智能体的治理与控制。

该平台将治理与控制扩展到模型和智能体运行框架之外,包括基础设施层,帮助组织为自主智能体设定并执行行为边界。

查看报道 ↗原始来源 ↗