微软在 Azure Pipelines 中推出 GitHub-hosted 代理并采用按量付费模式
微软正式向 Azure Pipelines 提供 GitHub-hosted 代理,并引入了按分钟计算的按量付费账单模式。
AI API 与开发工具的变化:功能、访问条件和开发选择。
微软正式向 Azure Pipelines 提供 GitHub-hosted 代理,并引入了按分钟计算的按量付费账单模式。
开发人员现可构建能够导航网站并在托管环境中与浏览器交互的 AI 智能体。
GitHub Copilot 在 CLI、App 及 SDK 中引入动态工作流,支持多步骤任务自动化。
Anthropic 的 Claude Sonnet 5.5 现已集成至 GitHub Copilot。符合条件的专业版及企业版用户可通过按量计费模式使用该模型。
Google Cloud 的 Data Agent Kit 现已正式发布,支持通过 Model Context Protocol 将编码代理连接至云端数据服务。
AWS 宣布将 Grok 4.7 引入 Amazon Bedrock 平台,提供 50 万 token 的上下文窗口及可调节的推理深度。
AWS 宣布在 Amazon Bedrock 中提供 Claude Sonnet 5.5,旨在通过更高的处理效率降低编程与文档处理任务的成本。
NVIDIA 推出全新开源平台,通过软硬件深度集成与实时监控,增强 AI 智能体在部署过程中的安全治理能力。
Google 更新了 Private AI Compute 平台,通过设备端密钥保护存储在云端的持久化数据,在保持用户上下文的同时确保隐私。
GPT-6 现支持提示词缓存优化,提供最高 90% 的输入令牌折扣,并允许在不中断缓存的情况下调整推理参数。
亚马逊在 Bedrock 平台推出 GPT-6 Sol 和 GPT-6 Luna,提供更低的 API 调用成本、提示词缓存支持以及更高的生成准确性。
亚马逊在其 Bedrock 平台中集成了 Anthropic 的 Claude Opus 5.5 模型,旨在提升任务处理效率并增加安全防护机制。
NVIDIA 推出了 Isaac ROS 5.0,引入了对 ROS Lyrical 和 Ubuntu 24.04 的支持,并增加了 AI 代理工作流。
Hugging Face 宣布 Transformers 库现已支持直接运行 GGUF 格式的量化模型,首发支持 Apple Silicon 架构。
Moonshot AI 推出的 Kimi K3 模型现已登陆 Amazon Bedrock,支持 100 万 token 上下文窗口与提示词缓存功能。
AWS 发布了 AgentCore 运行时,通过快照技术和内存动态回收机制,提升 AI 代理的冷启动性能和资源利用率。
Google Cloud 推出 Agent Substrate,这是一款用于 Google Kubernetes Engine 的开源执行运行时,旨在提高 AI 代理工作负载的部署密度和效率。
NVIDIA 公布了 Vera Rubin NVL72 系统在性能和能效方面的提升,旨在应对数据中心在运行复杂 AI 模型时的功耗约束。
Salesforce 与 AWS 推出多项集成更新,涵盖 CRM 数据接入、Slack AI 代理及 Amazon Bedrock 模型调用。
Salesforce 与 Google Cloud 宣布扩展合作伙伴关系,通过集成 headless 架构与 Gemini Enterprise,实现跨平台 AI 代理互操作性。
Google 说明了 Gemini 3.5 Transcribe 的开发功能:实时转写、最多 1000 个自定义术语,以及处理最长一小时的音频文件。
Google Cloud 推出 google-cloud-developer 插件,通过标准化手段简化 AI 代理与云环境的集成流程。
OpenAI 正式推出 Agents API 公测版,提供持久化会话、上下文压缩及受管的基础设施,简化自主代理的构建流程。
OpenAI 正式发布 GPT-Live-1 API,支持开发者构建具备实时中断与停顿处理功能的全双工语音智能体,语音层定价为每分钟 0.05 美元。
亚马逊宣布在 Amazon Bedrock 上推出 OpenAI 的 GPT-6 Astra 模型,该模型支持百万级 token 上下文窗口,并强化了网络安全能力。
Salesforce 引入 MCP 标准,使 AI 智能体能够直接安全地调用企业数据和业务逻辑,无需构建复杂的自定义集成。
NVIDIA Personal AI Router (PAIR) 可将本地网络内的多台计算设备资源进行整合,显著提升多智能体工作流的执行效率。