跳到正文

#产品更新

今日 4 条
今天10月2日周五
  1. NVIDIA Blog63

    NVIDIA GPU 如何加速 OpenAI 的 GPT-6 Astra Ultrafast

    GPT-6 Astra Ultrafast 现已在 OpenAI API 及符合条件的 ChatGPT Work 与 Codex 用户中可用,基于 NVIDIA Blackwell GPU 推理优化,token 生成速度较 Astra Standard 模式最高提升 8 倍。

    推荐理由:GPT-6 Astra Ultrafast 在 Blackwell 上比标准模式快最多8倍,可缩短编码智能体在工具调用间的等待,提升交互流畅度。

  2. AWS Machine Learning Blog35

    Amazon Quick 推出 Live Data in Apps 功能

    Amazon Quick 推出 Live Data in Apps 功能,允许 AI 构建的应用实时查询受治理的 Quick Sight 数据集。该功能支持 SPICE 和 Direct Query 模式,自动应用行级与列级安全规则,确保用户仅查看授权数据。此前应用仅展示构建时的静态快照,无法反映实时业务指标。

10月1日周四
  1. AWS Machine Learning Blog31

    Condé Nast 如何利用 Amazon Bedrock 构建多模态视频发现系统

    Condé Nast 基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频发现系统,将内容检索时间从 250 分钟缩短至 2 分钟以内。该系统采用 TwelveLabs Marengo 嵌入模型,对超过 140,000 个视频的转录、视觉和音频信号进行联合编码,支持基于意图的语义搜索。此前编辑团队依赖标题和描述手动查找素材,导致运营效率低下。

9月30日周三
  1. Google DeepMind68

    Google DeepMind 发布 SynthID Bio 合成生物水印技术

    Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,在保持蛋白质生物功能的同时嵌入可验证签名。实验显示,水印设计在结合亲和力和序列多样性上与无水印版本相当,并成功创建了首个具有生物功能的水印蛋白质结合器。

    推荐理由:原文展示了在保持生物功能前提下对蛋白质进行水印验证的方法,为合成生物安全提供了新的技术路径。

  2. NVIDIA Blog76

    NVIDIA 与 CoreWeave 推出 Vera Rubin NVL72 及 Forge 平台,加速 Agentic AI 生产落地

    CoreWeave 宣布在 CoreWeave Cloud 上提供 NVIDIA Vera Rubin NVL72 系统,Cognition 成为首个在生产环境中运行该系统的客户,其 Devin 推理工作负载的 token 吞吐量较 GB200 NVL72 提升 4.8 倍。

    推荐理由:原文展示了 Vera Rubin 在真实编码负载下的吞吐量提升,以及 CoreWeave Forge 如何打通从生产反馈到模型训练的闭环。

9月29日周二
  1. AWS Machine Learning Blog62

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度。

    推荐理由:梳理了 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,可据此估算长任务智能体的成本与延迟取舍。

9月28日周一
9月26日周六
9月25日周五
  1. GitHub Blog · AI & ML73

    GitHub Security Lab 发布基于 Taskflow Agent 的 AI 模糊测试工具

    GitHub Security Lab 发布了 Fuzzing Taskflow,一个针对 C/C++ 项目的自主模糊测试流水线,默认使用 Claude Sonnet 5 驱动。该工具通过 MCP 工具调用 AFL++ 和编译器,自动完成入口点识别、Harness 编写、覆盖率分析及崩溃分诊,并生成包含漏洞判定和修复建议的报告。

    推荐理由:展示了 LLM Agent 如何接管模糊测试中编写 Harness、分析覆盖率及分诊崩溃等重复性人工环节,为 C/C++ 项目自动化安全审计提供了可复用的工程范式。

  2. Google DeepMind76

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,通过低延迟流式视频与语音结合实现近实时视觉存在。该功能支持 97 种语言的唇形同步,并能在对话进行中后台异步执行工具调用,目前已通过 Gemini Enterprise 开放。

    推荐理由:原文展示了实时视频与语音结合的多模态交互能力,以及后台异步工具调用机制,为构建企业级虚拟助手提供了具体参考。

9月24日周四
  1. NVIDIA Blog60

    NVIDIA 与 Google DeepMind 等机构开放 2800 多种病毒蛋白复合物 3D 结构预测数据

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放了超过 2800 种病毒的蛋白复合物 3D 结构预测数据。该数据集利用 AlphaFold2 和 NVIDIA BioNeMo Inference Runtime 生成,其中约 30% 的蛋白相互作用是科学界首次记录,旨在帮助科学家提前储备应对未来大流行的知识。

    推荐理由:NVIDIA 与 Google DeepMind 等机构开放了 2800 多种病毒的蛋白复合物 3D 结构预测数据,为未来疫情应对提供基础生物学知识储备。

  2. Google DeepMind75

    Google DeepMind 发布 Private AI Compute 安全服务端记忆架构

    Google DeepMind 发布 Private AI Compute 平台的安全服务端记忆架构,实现跨设备持久 AI 记忆并维持端侧隐私标准。该架构利用云端安全飞地(secure enclave)和端到端加密通道,加密密钥仅保留在用户个人设备上,确保数据对包括 Google 在内的任何第三方不可访问。

    推荐理由:原文展示了云端持久记忆与端侧密钥控制的架构,为跨设备隐私计算提供了可验证的技术路径。

9月23日周三
9月22日周二
  1. NVIDIA Blog63

    NVIDIA Isaac ROS 5.0 发布,推进智能体驱动的开源机器人开发

    NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,引入智能体工作流以加速机器人应用构建与部署。该版本支持 ROS Lyrical 和 Ubuntu 24.04,提供 FoundationPose 推理库使物体位姿估计速度提升 5.5 倍,并包含用于设置和操作的 Isaac 技能。

    推荐理由:Isaac ROS 5.0 引入智能体工作流与 FoundationPose 加速,为开发者提供从构建到部署的完整物理 AI 开发路径。

  2. Hugging Face Blog82

    Transformers 支持运行 llama.cpp GGUF 量化模型

    Hugging Face 宣布 transformers 库新增对 GGUF 格式模型的支持,允许用户通过 from_pretrained 接口在本地加载并运行量化模型。该功能目前主要面向 Apple Silicon 设备,通过复用 ggml 内核实现接近 llama.cpp 的推理性能,并支持通过 transformers serve 暴露 OpenAI 兼容 API。

    推荐理由:原文展示了在 transformers 中直接加载 GGUF 量化模型的方法,并给出了 Apple Silicon 上的性能对比数据。

9月21日周一

© 2026 SI·Hot · Super Intelligence Hot · 超级智能热点 · 网站数据均来源于网络公开资料,版权归来源方所有