NVIDIA 发布 Open Agent Safety Platform 以保障 AI 智能体安全
NVIDIA 推出全新开源平台,通过软硬件深度集成与实时监控,增强 AI 智能体在部署过程中的安全治理能力。
NVIDIA↗
与该主题相关的 AI 新闻与实践文章。
NVIDIA 推出全新开源平台,通过软硬件深度集成与实时监控,增强 AI 智能体在部署过程中的安全治理能力。
Google 更新了 Private AI Compute 平台,通过设备端密钥保护存储在云端的持久化数据,在保持用户上下文的同时确保隐私。
GPT-6 现支持提示词缓存优化,提供最高 90% 的输入令牌折扣,并允许在不中断缓存的情况下调整推理参数。
亚马逊在 Bedrock 平台推出 GPT-6 Sol 和 GPT-6 Luna,提供更低的 API 调用成本、提示词缓存支持以及更高的生成准确性。
OpenAI 推出 GPT-6 Sol 和 Luna 模型,通过降低 API 成本并优化提示词缓存,为专业用户提升处理效率。
Hugging Face 宣布 Transformers 库现已支持直接运行 GGUF 格式的量化模型,首发支持 Apple Silicon 架构。
AWS 发布了 AgentCore 运行时,通过快照技术和内存动态回收机制,提升 AI 代理的冷启动性能和资源利用率。
Google Cloud 发布 Filestore Agent Volumes,旨在为 GKE 中的 AI 代理工作负载提供弹性且隔离的存储空间。
NVIDIA 公布了 Vera Rubin NVL72 系统在性能和能效方面的提升,旨在应对数据中心在运行复杂 AI 模型时的功耗约束。
Salesforce 与 AWS 推出多项集成更新,涵盖 CRM 数据接入、Slack AI 代理及 Amazon Bedrock 模型调用。
NVIDIA Personal AI Router (PAIR) 可将本地网络内的多台计算设备资源进行整合,显著提升多智能体工作流的执行效率。