跳到正文

动态

今日 6 条
9月16日周三
  1. Mistral AI62

    Mistral 与 Mozilla 合作将开源多语言 AI 引入 Firefox 浏览器

    Mistral 宣布与 Mozilla 建立合作伙伴关系,Firefox Smart Window(beta)现由 Mistral 模型驱动。该功能旨在帮助用户理解复杂搜索、记忆点击过的内容并基于浏览器标签页溯源信息,目前面向法国和北美用户开放,英国和德国预计今年晚些时候跟进。

    推荐理由:Mistral 与 Mozilla 合作将开源模型引入 Firefox,展示了隐私优先的浏览器 AI 落地路径。

9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. OpenAI News62

    OpenAI 向所有人开放 ChatGPT Work 的 Data agent

    OpenAI 宣布 ChatGPT Work 中的 Data agent 现已向所有人开放。该智能体可连接企业数据、发现洞察,并用自然语言构建交互式仪表盘。

    推荐理由:OpenAI 官方披露 ChatGPT Work 中 Data agent 的开放范围与自然语言建看板能力,可据此判断企业数据接入方式的变化。

  2. OpenAI News62

    OpenAI 推出面向金融服务的 ChatGPT

    OpenAI 推出 ChatGPT for Financial Services,内置金融数据并搭载 GPT-6 Astra,用于研究、建模和生成可直接交付客户的材料。

    推荐理由:官方给出面向金融服务的 ChatGPT 版本及其内置金融数据与模型组合,可据此判断其目标场景。

  3. Hugging Face Blog62

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111

    Hugging Face 发布 Workflow1111,用 73 个节点、11 条媒体管线在单张 Gradio Workflow 画布上重建了 AUTOMATIC1111 的大部分功能,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 和图像转视频。

    推荐理由:用 73 个节点复刻 A1111 全部功能,并展示输出节点如何自动变成 REST 端点和 MCP 工具。

  4. OpenAI News70

    OpenAI 在 API 中上线 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,为开发者带来自然的全双工语音对话能力。该模型在指令遵循上更强,并支持自定义音色和电话(telephony)接入。

    推荐理由:OpenAI 把全双工语音对话能力开放到 API,开发者可据此判断语音应用的接入方式。

  5. OpenAI News68

    OpenAI 发布 Agents API

    OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。

    推荐理由:OpenAI 官方发布 Agents API,读者可了解其托管服务定位与 Codex harness 编排能力。

9月9日周三
9月8日周二
  1. Google DeepMind73

    Google DeepMind 发布 AlphaGenome Atlas 全基因组变异预测平台

    Google DeepMind 发布 AlphaGenome Atlas,提供人类基因组中 90 亿种单核苷酸变异的分子效应预测。该平台包含 1PB 数据集,并推出 AVI 评分以整合 AlphaGenome 和 AlphaMissense 的预测结果,帮助研究人员快速排序和解读基因变异。

    推荐理由:原文展示了覆盖全基因组 90 亿种变异的预测平台,为遗传学研究提供了可复用的分子效应评估工具。

  2. OpenAI News62

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像,更贴近用户原本的构想。

    推荐理由:OpenAI 官方发布 ChatGPT Images 2.5,读者可了解其把草图与参考照片转为个性化成图的定位。

9月5日周六
  1. GitHub Blog · AI & ML71

    GitHub 推出 Project HydraFusion 多模型编排研究预览

    GitHub 发布 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型间选择执行方案,用户可在 GitHub Copilot CLI 中用 /experimental 启用,按各模型标准费率计费。

    推荐理由:GitHub 给出多模型编排的三种执行模式与三个基准上的质量成本对比,可据此判断编排式编码智能体的取舍。

9月3日周四
  1. Google DeepMind72

    Google DeepMind 发布 Fairwind 计划,面向政府和企业提供主动网络防御能力

    Google DeepMind 推出 Fairwind 计划,向政府及可信合作伙伴提供基于 Gemini 3.8 Flash Cyber 和 CodeMender 的主动网络防御能力。该计划旨在帮助防御方在安全云环境中自主发现、验证并修复漏洞,将修复时间从数周缩短至数分钟,目前全球已有超过 650 家合作伙伴参与。

    推荐理由:原文展示了利用 Gemini 3.8 Flash Cyber 实现漏洞自动修复的流程,为防御方提供了应对智能体威胁的具体工具路径。

9月2日周三
9月1日周二
  1. Hugging Face Blog62

    Hugging Face 发布 @huggingface/kernels:207 个 WebGPU 内核与 Fleet 测试套件

    Hugging Face 发布 @huggingface/kernels,一个从 Hugging Face Hub 加载并运行优化 WebGPU 内核的轻量库,同时上线 207 个内核的初始集合,均以独立仓库形式发布并采用 Apache-2.0 许可。

    推荐理由:Hugging Face 把浏览器推理的底层算子做成可版本化、可测试的独立仓库,并给出与 ORT WebGPU 的实测对比。

8月25日周二
  1. Hugging Face Blog62

    Gradio 推出 gr.Workflow,把 AI 流水线做成可拖拽画布与 REST API

    Hugging Face 在 Gradio 中内置 gr.Workflow,把多步 AI 流水线描述为带类型端口的节点图,Gradio 会渲染成可拖拽画布,每个节点可运行、每个中间结果可见。

    推荐理由:原文用五个可运行的 Space 演示了把多步模型调用串成图并自动暴露 REST 接口的做法,读者可据此判断现有 Python 流水线能否迁移。

8月20日周四
  1. Mistral AI82

    Mistral 发布 Agentic Search 提升复杂文档检索准确性

    Mistral 发布 Agentic Search,通过多步检索循环提升 AI 系统在复杂文档中的信息检索准确性与效率。在 FinanceBench 基准上,其正确率从 26.7% 提升至 86%,p90 延迟降低 39.6%。该功能通过 Mistral Search Toolkit 和 Libraries 提供,支持在云端或本地部署中处理敏感领域数据。

    推荐理由:原文展示了 Agentic Search 在 FinanceBench 和 OfficeQA Pro 上的具体性能提升,为复杂文档检索提供了可量化的对比基准。

8月13日周四
8月11日周二
  1. Mistral AI68

    Mistral 推出区域推理端点、第三方开源模型支持及欧洲算力联盟

    Mistral 宣布推出 Mistral Regional Endpoints 和 Mistral Priority Tier,允许用户选择在欧洲或美国进行推理,并提供带 SLA 的优先服务层级。平台将支持第三方开源模型,首批引入 Z.ai 的 GLM-5.2,并联合企业组建联盟以锁定欧洲长期算力,计划到 2030 年建设最高 1 GW 的算力容量。

    推荐理由:Mistral 推出区域推理端点与第三方开源模型支持,并联合企业锁定欧洲算力,为构建主权 AI 基础设施提供具体路径。

8月6日周四
8月4日周二
  1. Microsoft Research71

    微软研究院开源 Orchard:可扩展智能体 AI 框架

    微软研究院发布开源框架 Orchard,核心是 Orchard Env 这一基于 Kubernetes 的可复用环境服务,支持软件工程、网页导航和个人助理三类智能体,并可直接在 Codex、OpenClaw、ZeroClaw 等真实部署框架内训练。

    推荐理由:微软研究院开源了可复用的智能体环境服务与三套训练配方,读者可据此了解小模型在真实任务上的训练路径。

7月23日周四
  1. Hugging Face Blog62

    Hugging Face 将 Nunchaku 4-bit 扩散推理引入 Diffusers

    Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 4-bit 量化 checkpoint,无需自定义 pipeline 或本地 CUDA 编译。

    推荐理由:原文给出了 Nunchaku Lite 在 Diffusers 中的加载方式与实测延迟和显存数据,读者可据此判断消费级 GPU 跑扩散模型的实际收益。

7月13日周一
7月9日周四
  1. Mistral AI40

    Mistral Studio 为 Prompts 和 Skills 提供系统化记录管理

    Mistral Studio 即日起为 Prompts 和 Skills 提供集中化系统记录,每个资产可版本化、归属明确且可追溯。不可变版本、回滚、审计日志和分类标签等功能,让非开发者的业务团队也能直接迭代并部署生产指令,同时触发既有 CI/CD 流程。Skills 可作为 MCP 服务器直接从 Studio 调用,确保生产执行的是受治理的同一版本资产。

7月8日周三
  1. Hugging Face Blog62

    Hugging Face 让 vLLM 的 transformers 建模后端达到原生速度

    Hugging Face 宣布 vLLM 的 transformers 建模后端在多个 LLM 架构上已追平甚至超过 vLLM 手写原生实现的吞吐。该后端通过 torch.fx 做静态图分析、用 ast 重写源码,在运行时动态应用推理相关的层融合,从而匹配自定义实现的性能,并可与张量并行、数据并行、专家并行等常规配置组合。

    推荐理由:原文给出了 transformers 后端在 vLLM 中追平原生实现的具体做法与启用方式,读者可据此判断现有部署是否需要改动。

7月7日周二
  1. Hugging Face Blog62

    微软在 Foundry Managed Compute 上线 Hugging Face 模型集合

    微软在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集合,将开源权重模型以每周刷新、一键部署的方式接入 Foundry,权重预存于 Azure,运行时由微软构建并扫描。

    推荐理由:微软与 Hugging Face 合作把开源权重模型接入 Foundry,读者可了解企业部署开源模型时被补齐的运维环节。

  2. Hugging Face Blog75

    LeRobot v0.6.0 发布:想象、评估、改进

    Hugging Face 发布 LeRobot v0.6.0,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一的奖励模型 API(Robometer、TOPReward)。

    推荐理由:原文把世界模型策略、奖励模型 API 与六个仿真基准整合进同一套 CLI,读者可据此判断机器人学习闭环的工程化程度。

  3. Hugging Face Blog62

    SkyPilot 与 Hugging Face 打通零出口流量存储,可在任意云运行 AI 负载

    SkyPilot 与 Hugging Face 联合推出 store: hf 后端,用一条 hf:// URL 和现有 HF_TOKEN 即可把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20 多个云、Kubernetes、Slurm 和本地集群上运行。

    推荐理由:原文给出零出口流量存储与跨云调度的组合方式,读者可据此判断数据与 GPU 分离时的成本与工作流变化。

7月6日周一
7月1日周三

© 2026 SI·Hot · Super Intelligence Hot · 超级智能热点 · 网站数据均来源于网络公开资料,版权归来源方所有