跳到正文

#Agent

今日 7 条
今天10月2日周五
  1. NVIDIA Blog63

    NVIDIA GPU 如何加速 OpenAI 的 GPT-6 Astra Ultrafast

    GPT-6 Astra Ultrafast 现已在 OpenAI API 及符合条件的 ChatGPT Work 与 Codex 用户中可用,基于 NVIDIA Blackwell GPU 推理优化,token 生成速度较 Astra Standard 模式最高提升 8 倍。

    推荐理由:GPT-6 Astra Ultrafast 在 Blackwell 上比标准模式快最多8倍,可缩短编码智能体在工具调用间的等待,提升交互流畅度。

  2. AWS Machine Learning Blog43

    Amazon Bedrock AgentCore 利用 Agentic AI 加速云迁移

    基于 Amazon Bedrock AgentCore 的四智能体模式将大型云迁移项目中每个应用的 IaC 开发时间从 3 到 4 周缩短至几分钟。该方案通过 MCP 工具连接内部系统,与 AWS Transform 和 AWS DMS 配合,覆盖 300 多个应用的迁移及运维需求。此前此类定制化 IaC 组合需耗费数年工程人力,此模式实现了自动化治理与监控。

  3. AWS Machine Learning Blog35

    Amazon Quick 推出 Live Data in Apps 功能

    Amazon Quick 推出 Live Data in Apps 功能,允许 AI 构建的应用实时查询受治理的 Quick Sight 数据集。该功能支持 SPICE 和 Direct Query 模式,自动应用行级与列级安全规则,确保用户仅查看授权数据。此前应用仅展示构建时的静态快照,无法反映实时业务指标。

  4. AWS Machine Learning Blog41

    使用 NVIDIA NeMo Agent Toolkit 和 Amazon S3 Vectors 构建智能体记忆

    文章展示了如何在 Amazon EKS 上部署 NVIDIA NeMo Agent Toolkit (NAT) 1.6,并将 Amazon S3 Vectors 实现为自定义持久记忆层。该方案利用 S3 Vectors 支持单索引 20 亿向量及强写入一致性,满足生产级多智能体系统对弹性存储和成本效率的需求。这是继此前探讨 S3 Vectors 架构优势后,进一步落地具体实现的技术指南。

  5. AWS Machine Learning Blog47

    Amazon Payments 利用 AWS SageMaker AI 上的上下文多臂老虎机优化获客漏斗

    Amazon Payments 在 Amazon SageMaker AI 上部署多目标上下文多臂老虎机(MAB),用于优化产品获客漏斗中的个性化内容选择。七周在线 A/B 测试显示,针对特定客户群体,最终漏斗转化率实现了高个位数的相对提升,但另一群体未见改善,表明问题在于内容而非模型。

10月1日周四
  1. Google DeepMind80

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展到开发者、企业和消费者,起价为每百万输入 token 2 美元、每百万输出 token 10 美元。

    推荐理由:官方给出 Argon 在长程编码、企业知识工作与网络安全防御上的基准与内部落地数据,可据此判断前沿模型的能力边界与分阶段开放节奏。

9月30日周三
  1. NVIDIA Blog76

    NVIDIA 与 CoreWeave 推出 Vera Rubin NVL72 及 Forge 平台,加速 Agentic AI 生产落地

    CoreWeave 宣布在 CoreWeave Cloud 上提供 NVIDIA Vera Rubin NVL72 系统,Cognition 成为首个在生产环境中运行该系统的客户,其 Devin 推理工作负载的 token 吞吐量较 GB200 NVL72 提升 4.8 倍。

    推荐理由:原文展示了 Vera Rubin 在真实编码负载下的吞吐量提升,以及 CoreWeave Forge 如何打通从生产反馈到模型训练的闭环。

  2. AWS Machine Learning Blog83

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,为编码、计算机使用和专业工作负载提供更强推理能力。OpenAI 表示该模型在 DeepSWE v1.1 上性能匹配 GPT-6 Astra,但单任务成本约为其五分之一,且比 GPT-6 Sol 最佳成绩高 6.4 个百分点。

    推荐理由:GPT-6.1 Sol 在 Amazon Bedrock 正式可用,以约五分之一成本实现接近 GPT-6 Astra 的推理能力,降低智能体工作流成本。

  3. AWS Machine Learning Blog35

    Amazon Quick 提示工程基础:核心原则与结构化框架

    本文阐述 Amazon Quick 提示工程的核心原则,包括通过具体性提升清晰度、利用业务背景增强相关性以及使用示例进行少样本学习。文章介绍了 CRISPE 框架,通过定义背景、角色、意图、步骤等维度构建结构化提示,以在 Quick 各组件中生成一致且高质量的 AI 输出。

  4. AWS Machine Learning Blog28

    Amazon Quick 各组件提示工程模式与陷阱

    文章解析 Amazon Quick 各组件的提示工程最佳实践。Quick Research 需明确目标、受众及范围,并限定数据源以减少噪音;Quick Flows 应将复杂逻辑拆解为编号步骤,利用 agentic runtime 通过对话迭代优化;Quick Sight 查询需包含业务问题、指标、维度及可视化偏好。

9月29日周二
  1. AWS Machine Learning Blog62

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度。

    推荐理由:梳理了 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,可据此估算长任务智能体的成本与延迟取舍。

9月28日周一
  1. Hugging Face Blog82

    H company 发布 Holo4 通用计算机使用智能体模型

    H company 发布 Holo4 系列智能体模型,包含 27B dense 和 35B-A3B MoE 两种规格,同时更新 Holotron4 Nano。Holo4 通过 GUI、代码、MCP 和 API 与软件交互,在 OSWorld 2.0 上 27B 版本得分 61.7%,35B-A3B 版本得分 30.9%。

    推荐理由:Holo4 支持 GUI、代码、MCP 和 API 多接口交互,在 OSWorld 2.0 上以更低成本接近闭源模型表现。

9月26日周六
9月25日周五
  1. GitHub Blog · AI & ML73

    GitHub Security Lab 发布基于 Taskflow Agent 的 AI 模糊测试工具

    GitHub Security Lab 发布了 Fuzzing Taskflow,一个针对 C/C++ 项目的自主模糊测试流水线,默认使用 Claude Sonnet 5 驱动。该工具通过 MCP 工具调用 AFL++ 和编译器,自动完成入口点识别、Harness 编写、覆盖率分析及崩溃分诊,并生成包含漏洞判定和修复建议的报告。

    推荐理由:展示了 LLM Agent 如何接管模糊测试中编写 Harness、分析覆盖率及分诊崩溃等重复性人工环节,为 C/C++ 项目自动化安全审计提供了可复用的工程范式。

  2. Google DeepMind76

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,通过低延迟流式视频与语音结合实现近实时视觉存在。该功能支持 97 种语言的唇形同步,并能在对话进行中后台异步执行工具调用,目前已通过 Gemini Enterprise 开放。

    推荐理由:原文展示了实时视频与语音结合的多模态交互能力,以及后台异步工具调用机制,为构建企业级虚拟助手提供了具体参考。

9月23日周三
9月22日周二
  1. NVIDIA Blog63

    NVIDIA Isaac ROS 5.0 发布,推进智能体驱动的开源机器人开发

    NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,引入智能体工作流以加速机器人应用构建与部署。该版本支持 ROS Lyrical 和 Ubuntu 24.04,提供 FoundationPose 推理库使物体位姿估计速度提升 5.5 倍,并包含用于设置和操作的 Isaac 技能。

    推荐理由:Isaac ROS 5.0 引入智能体工作流与 FoundationPose 加速,为开发者提供从构建到部署的完整物理 AI 开发路径。

9月21日周一
  1. NVIDIA Blog42

    NVIDIA:AI 安全是工程问题——如何在智能体栈的每一层解决它

    NVIDIA 提出 AI 安全应作为工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体之外强制执行策略并提供沙箱化执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。NVIDIA 还联合 Open Secure AI Alliance 推动研究成果与工具共享。

9月17日周四
  1. GitHub Blog · AI & ML88

    GitHub Copilot 运行时迁移至 Rust 的实践复盘

    GitHub 团队利用 Copilot 智能体将 Copilot 运行时从 TypeScript 完全重写为 80 万行 Rust 代码。该过程采用增量式原地迁移策略,通过 128 个 Pull Request 逐步替换组件,最终实现了性能的数量级提升。作者详细复盘了智能体在代码审查、上下文管理及多会话协作中的具体表现,揭示了 AI 辅助大规模代码重构的工程细节。

    推荐理由:展示了利用 AI 智能体在数周内完成 80 万行 Rust 代码迁移的工程实践,提供了大规模自动化重构的方法论参考。

9月16日周三

© 2026 SI·Hot · Super Intelligence Hot · 超级智能热点 · 网站数据均来源于网络公开资料,版权归来源方所有