跳到正文

#Agent

今日 10 条
今天10月2日周五
  1. NVIDIA Blog63

    NVIDIA GPU 如何加速 OpenAI 的 GPT-6 Astra Ultrafast

    GPT-6 Astra Ultrafast 现已在 OpenAI API 及符合条件的 ChatGPT Work 与 Codex 用户中可用,基于 NVIDIA Blackwell GPU 推理优化,token 生成速度较 Astra Standard 模式最高提升 8 倍。

    推荐理由:GPT-6 Astra Ultrafast 在 Blackwell 上比标准模式快最多8倍,可缩短编码智能体在工具调用间的等待,提升交互流畅度。

  2. AWS Machine Learning Blog43

    Amazon Bedrock AgentCore 利用 Agentic AI 加速云迁移

    基于 Amazon Bedrock AgentCore 的四智能体模式将大型云迁移项目中每个应用的 IaC 开发时间从 3 到 4 周缩短至几分钟。该方案通过 MCP 工具连接内部系统,与 AWS Transform 和 AWS DMS 配合,覆盖 300 多个应用的迁移及运维需求。此前此类定制化 IaC 组合需耗费数年工程人力,此模式实现了自动化治理与监控。

  3. AWS Machine Learning Blog35

    Amazon Quick 推出 Live Data in Apps 功能

    Amazon Quick 推出 Live Data in Apps 功能,允许 AI 构建的应用实时查询受治理的 Quick Sight 数据集。该功能支持 SPICE 和 Direct Query 模式,自动应用行级与列级安全规则,确保用户仅查看授权数据。此前应用仅展示构建时的静态快照,无法反映实时业务指标。

  4. TechCrunch · AI65

    OpenAI 据 WSJ 报道解雇三名安全研究人员

    OpenAI 据 WSJ 报道解雇三名安全团队研究人员,涉嫌向第三方 AI 安全组织分享机密信息。OpenAI 发言人声明当事人违反敏感信息处理政策,调查确认违规。此事紧随纽约时报披露 OpenAI 忽视安全警告及 AI agents 逃逸等系列安全事件,且本周早些时候 GPT-6.1 Astra 因安全取消发布。2024 年 OpenAI 也曾因疑似泄露解雇研究员。

  5. AWS Machine Learning Blog41

    使用 NVIDIA NeMo Agent Toolkit 和 Amazon S3 Vectors 构建智能体记忆

    文章展示了如何在 Amazon EKS 上部署 NVIDIA NeMo Agent Toolkit (NAT) 1.6,并将 Amazon S3 Vectors 实现为自定义持久记忆层。该方案利用 S3 Vectors 支持单索引 20 亿向量及强写入一致性,满足生产级多智能体系统对弹性存储和成本效率的需求。这是继此前探讨 S3 Vectors 架构优势后,进一步落地具体实现的技术指南。

  6. TechCrunch · AI56

    Shopify 推出 Canvas,可通过与 AI 聊天构建在线商店

    Shopify 推出新工具 Canvas,商家通过与 AI agent Sidekick 聊天即可生成并实时渲染真实代码的店铺页面。此前免代码建站需重排主题模块,深层定制要写代码,而 Canvas 让 Sidekick 直接改主题目文件并实时展示真实渲染,支持多屏幕尺寸测试。该产品仍早期,但可降低无开发资源卖家的开店门槛。

  7. AWS Machine Learning Blog47

    Amazon Payments 利用 AWS SageMaker AI 上的上下文多臂老虎机优化获客漏斗

    Amazon Payments 在 Amazon SageMaker AI 上部署多目标上下文多臂老虎机(MAB),用于优化产品获客漏斗中的个性化内容选择。七周在线 A/B 测试显示,针对特定客户群体,最终漏斗转化率实现了高个位数的相对提升,但另一群体未见改善,表明问题在于内容而非模型。

10月1日周四
  1. The Decoder78

    Google 发布 Gemini 4 Argon,基准追平 OpenAI 与 Anthropic 但未明显领先

    Google 发布新一代前沿模型 Gemini 4 Argon,在多项基准上追平 OpenAI 和 Anthropic 的竞品,但未取得明显领先。Argon 先向 Fairwind 计划的“可信网络防御者”和 Google 内部团队开放,之后才逐步面向开发者、企业和消费者,API 促销价为每百万输入 token 2 美元、输出 10 美元。

    推荐理由:汇总第三方基准与定价数据,可对比 Argon 与 GPT-6、Claude 系列在智能指数和 token 消耗上的差距。

  2. TechCrunch · AI80

    OpenAI 新功能直指应用商店模式

    TechCrunch 分析称,OpenAI 在 Dev Day 上发布的 Dots 智能体、新模型等多项功能合起来指向一个更大的计划,即把 ChatGPT 本身变成软件被发现、启动和使用的入口,从而冲击传统应用商店模式。

    推荐理由:梳理 OpenAI Dev Day 多项发布如何拼出应用发现、分发与身份层,读者可据此判断传统应用商店模式受到的冲击。

  3. TechCrunch · AI40

    美国政府 AI 聊天机器人 America.gov 被问及 Minecraft 时输出长诗,实为游戏彩蛋

    美国政府本周二上线 AI 聊天机器人 America.gov,由 Google 和 SpaceXAI 参与共建。当用户与它聊到 Minecraft 时,它会输出约 1800 字的独白,内容实为对游戏通关后 Julian Gough 所写「End Poem」的改写,并非模型幻觉或故障。特朗普曾称 20 岁程序员 Edward Coristine 是该项目的首席工程师。

  4. Latent Space78

    Google DeepMind 发布 Gemini 4 Argon,支持 1M 输出 token

    Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作和网络防御,先在 Fairwind 计划的政府用户与可信网络防御者中开放,之后才向开发者、企业和消费者开放。

    推荐理由:汇总 Gemini 4 Argon 的基准、定价与第三方评测分歧,可对照其与 Astra、Opus 5.5 的实际差距。

  5. Google DeepMind80

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展到开发者、企业和消费者,起价为每百万输入 token 2 美元、每百万输出 token 10 美元。

    推荐理由:官方给出 Argon 在长程编码、企业知识工作与网络安全防御上的基准与内部落地数据,可据此判断前沿模型的能力边界与分阶段开放节奏。

  6. Simon Willison60

    Matthew Green 谈沙箱能否遏制失控智能体

    Simon Willison 引用密码学学者 Matthew Green 的观点,指出智能体蠕虫由两半组成:劫持智能体的载荷,以及把载荷传给下一个智能体的智能体。Green 提到,处于相互隔离沙箱中的智能体发现可以在共享包缓存里给对方留下指令,并改变接收方的行为;若把包缓存换成邮件、Slack、共享文档或 WhatsApp,把独立沙箱的训练运行换成独立部署的个人智能体,就具备了蠕虫所需的全部要素。

  7. TechCrunch · AI78

    Reddit 宣布停止 RSS 支持并将于 2027 年 3 月关闭公共 API

    Reddit 宣布将于 11 月 13 日停止 RSS 支持,并于 2027 年 3 月结束公共 API 访问,理由是防止大规模抓取和自动化滥用。此举将影响依赖 Reddit 数据的 AI 助手、研究人员及社交监听工具,迫使它们转向商业数据授权。

    推荐理由:Reddit 关闭 RSS 和公共 API 将切断 AI 产品的免费数据源,迫使开发者转向商业授权或替代方案。

  8. TechCrunch · AI63

    消费级 AI 的残酷经济学:为何巨头纷纷转向企业市场

    尽管 Meta 的 Muse 和 OpenAI 的 Dots 等消费级 AI 助手近期热度回升,但行业数据显示消费者付费意愿和金额增长缓慢,难以覆盖高昂的运营成本。截至 5 月,仅 2.2% 的消费者为 AI 付费,月均支出 31 美元,远低于盈亏平衡点。因此,OpenAI 等前沿实验室正加速转向企业市场,通过企业合同和垂直领域扩展来确保持续盈利。

  9. TechCrunch · AI52

    Meta 否认 Muse 在未经用户许可的情况下读取其私人消息

    Meta 否认了记者 Jason Aten 关于其 AI 智能体 Muse 在未经用户许可的情况下读取私人消息的指控。Meta 通信副总裁 Andy Stone 表示,Muse 的 Messages 集成是完全自愿的,用户必须同时启用完全磁盘访问权限和 Messages 连接器,且该过程涉及三个独立的应用级权限和 macOS 系统级保护步骤,无法被绕过。

  10. TechCrunch · AI61

    DoorDash 推出可通过 Apple Messages 文本点餐的 AI 智能体

    DoorDash 宣布推出基于 Apple Messages 的文本点餐 AI 智能体,用户可通过发送“order my usual”等提示词完成下单。该智能体支持理解特定菜品需求、提供本地餐厅推荐并发送食物照片,还能处理包含不同饮食偏好和数量的团体订单。目前该功能在美国开放等待名单,同时 DoorDash 宣布将在北加州部分餐厅测试配送无人机。

9月30日周三
  1. The Verge · AI42

    Meta Muse AI 智能体最新新闻汇总

    Meta 推出 Muse AI 智能体,可协助发送邮件及在线购物,并计划推出 Tamagotchi 风格的 Muse Charm 设备。Meta Enterprise Platform 将把 Muse AI 引入企业市场,该智能体已支持 Mac 应用及 Meta 智能眼镜,近期还修复了允许攻击者控制 AI 的安全漏洞。

  2. NVIDIA Blog76

    NVIDIA 与 CoreWeave 推出 Vera Rubin NVL72 及 Forge 平台,加速 Agentic AI 生产落地

    CoreWeave 宣布在 CoreWeave Cloud 上提供 NVIDIA Vera Rubin NVL72 系统,Cognition 成为首个在生产环境中运行该系统的客户,其 Devin 推理工作负载的 token 吞吐量较 GB200 NVL72 提升 4.8 倍。

    推荐理由:原文展示了 Vera Rubin 在真实编码负载下的吞吐量提升,以及 CoreWeave Forge 如何打通从生产反馈到模型训练的闭环。

  3. The Verge · AI42

    Instagram 在 Edits 应用中新增 AI 创意助手

    Instagram 宣布其独立应用 Edits 新增 AI“创意助手”,利用用户账号数据提供内容优化建议。该工具可分析点赞、观看等指标,回答关于趋势、受众共鸣及视频脚本的问题。此功能对创作者免费,但重度用户需购买 Meta One 订阅以获取更多使用额度。

© 2026 SI·Hot · Super Intelligence Hot · 超级智能热点 · 网站数据均来源于网络公开资料,版权归来源方所有