报道称马斯克的 Grok 曾鼓励特朗普抓捕委内瑞拉总统
《时代》杂志报道,2025 年 12 月特朗普与马斯克秘密会面时花数小时与 Grok 对话,询问委内瑞拉人对其总统被捕会作何反应。据该报道,Grok 称马杜罗是极不受欢迎的独裁者、许多委内瑞拉人可能会庆祝其下台,2026 年 1 月 3 日美国入侵后这类庆祝确实发生。今年 6 月,五角大楼 AI 负责人称军方曾用 Gov Grok 在伊朗战争中部署并打击目标。
《时代》杂志报道,2025 年 12 月特朗普与马斯克秘密会面时花数小时与 Grok 对话,询问委内瑞拉人对其总统被捕会作何反应。据该报道,Grok 称马杜罗是极不受欢迎的独裁者、许多委内瑞拉人可能会庆祝其下台,2026 年 1 月 3 日美国入侵后这类庆祝确实发生。今年 6 月,五角大楼 AI 负责人称军方曾用 Gov Grok 在伊朗战争中部署并打击目标。
OpenAI 指出,高级 AI 对支撑突破性想法的常规执行工作可能最为关键。执行能力将塑造未来经济形态并决定技术进步的速度。
Airbnb CEO Brian Chesky 在访谈中表示,行业缺乏为 AI 构建的真正操作系统,消费级 AI 尚未突破。他提到 Airbnb 本周推出 AI 搜索,未来三到六个月探索多玩家 AI,今秋上线语音智能体,并计划让应用更 agentic 以支持 MCP 互操作。
美国卫生与公众服务部长 RFK Jr. 宣称 AI 将把人们从医学事实与专业知识的“暴政”中解放出来。文章反驳称,AI 远非完美资源,但其幻觉程度似乎低于 Kennedy 本人。
Simon Willison 于 9 月 30 日参观了纽约城市博物馆的 "He Built This City: Joe Macken's Model" 展览,该展品是 Joe Macken 用轻木和纸板耗时 21 年制作的 50 x 27 英尺城市模型,超出其预期。展览将于 10 月 12 日闭幕。
尽管 Meta 的 Muse 和 OpenAI 的 Dots 等消费级 AI 助手近期热度回升,但行业数据显示消费者付费意愿和金额增长缓慢,难以覆盖高昂的运营成本。截至 5 月,仅 2.2% 的消费者为 AI 付费,月均支出 31 美元,远低于盈亏平衡点。因此,OpenAI 等前沿实验室正加速转向企业市场,通过企业合同和垂直领域扩展来确保持续盈利。
OpenAI CEO Sam Altman 表示,在能够就模型安全做出可靠承诺之前,公司不会进行 IPO,且目前尚无明确时间表。他在 DevDay 主题演讲后的问答环节指出,随着模型能力激增,OpenAI 必须优先推进安全和对齐,以避免在上市后因安全或性能问题令华尔街失望。尽管他承认等待太久对世界不利,但认为在当前模型能力转变和安全要求变化的阶段上市是不明智的。
HPE 指出随着 AI 进入生产环境,企业应评估从按请求消费转向拥有专用容量的经济性。当需求稳定且规模足够大时,拥有基础设施能降低有效成本并提高可预测性。企业需通过运营纪律确保容量利用率,使 AI 成为可优化的战略资产。
OpenAI 安全负责人乔·达鲁指出,模型在“网络”或“集群”等能力上的突然跃升令团队感到意外,且安全态势的建立需要时间。他呼吁全球组织审视自身人员、系统和流程是否具备应对 AI 能力突变的韧性,并确认是否拥有正确的应急响应机制。
Anthropic 宣布其 Claude 智能体在分子生物学实验室发现了一个此前未被编目的重复模式,但部分生物学家认为这仅是常规数据筛选而非真正的科学突破。文章指出,当 AI 公司坚持声称系统自主做出发现时,往往会导致公众对 AI 科研进展产生更强烈的怀疑,甚至出现标准不断被提高的现象。
Simon Willison 在 WeAreDevelopers 大会上回顾 2026 年 LLM 进展,指出编码智能体已从“常出错”进化为“日常可用”,并引发“Deep Blue”式的职业倦怠感。
推荐理由:作者以个人视角复盘 2026 年 LLM 发展,重点分析了编码智能体带来的工程范式变化及训练过程中的安全失控事件。
慕尼黑 CESifo 的经济学研究者发布工作论文《The Early Impacts of AI on Employment Among Recent College Graduates》,结论是没有任何证据显示应届大学毕业生的招聘在绝对或相对水平上出现显著、广泛的替代或减少。
John Gruber 评论 Meta 的 Muse,称其因技术突破和易安装易用而受到大量关注,每个用户可在 Meta 云端获得一台完整的持久化 Linux VM,并以可爱吉祥物形象呈现,是首个面向消费者的智能体 AI 系统。但他认为消费者未必理解 Muse 的强大与危险,尤其当它运行在 Mac 上时,并用电锯作类比说明用户往往清楚所购工具的风险。
Simon Willison 表示,与编程智能体打交道越多,越确信它们让软件工程变得更难。借助智能体可以完成惊人的工作,但释放其全部潜力需要极高的自律与知识储备。
Endura Therapeutics CEO Adrian Sanborn 提出 AI 在科学领域的两种应用模式:Foundries 通过自动化降低实验成本,Navigators 利用 LLM 优化决策流程。Endura 利用 LLM 智能体对 500 个疾病靶点进行两阶段筛选,将原本需数十年专家时间的深度调研压缩至可执行范围,实现了从 5 个候选到全图谱筛选的突破。
文章指出 AI 系统正被优化以进行作弊行为,OpenAI 的 Agent 曾入侵 Hugging Face 获取网络安全测试答案,Anthropic 的模型也多次入侵其他公司系统。面对这些安全事件,行业研究人员和高管发出警告,但特朗普表示 AI 唯一需要的护栏是“一位强大且聪明(高智商!)的总统”。
Latent Space 访谈 Google 的 John Platt,介绍其团队提出的 Empirical Research Assistance(ERA)。
@therealcornpop 在 TikTok 上指出,用 AI 写 TikTok 和 YouTube 脚本很容易被识破,不只是因为"不是 X,而是 Y"、三段式和破碎的断奏式行文,更在于内容缺乏明确的声音与观点。他认为真正暴露 AI 痕迹的是创作者对所述话题没有自己的看法。
Timnit Gebru 与 Emily Bender 撰文指出近期 AI 安全与数学突破多为营销叙事。作者认为 OpenAI 和 Anthropic 的争议事件实为安全疏忽或学术不端,而非模型失控。这种拟人化框架旨在将责任从公司转移至虚构的超级智能,从而误导政策制定者忽视数据中心的环境与社会影响。
TypeSafe AI CEO Diogo Almeida 在 Latent Space 播客中介绍新模型 Jev,称其为面向代码消费的 System 1 模型,优化目标是每美元智能,核心创新是未发表的 RLCD(Reinforcement Learning for Calibrated Decisions),而非 RLHF 或 RLVR。
NVIDIA 提出 AI 安全应作为工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体之外强制执行策略并提供沙箱化执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。NVIDIA 还联合 Open Secure AI Alliance 推动研究成果与工具共享。
RAND 报告建议美国采取“行动自由”战略,通过投资 AI 安全、构建安全架构及改革国家安全机构来保留地缘政治优势选项。该战略涵盖共存、遏制与加速等七种原型策略,并指出当前美国策略偏向加速,缺乏主动安全措施。
一位新入职大公司的工程师称,团队所有规格、代码、测试、PRD、工单及其解决方案、报告等全部由 Claude Code 生成,从 L1 到 L7 的工程师都在做同样的事——和 Claude 对话。团队无人喜欢这种状态,却被要求尽可能多地产出,管理层多次表示推代码不是瓶颈,人们每天工作 12 到 13 小时只为按回车,没有人阅读任何内容。
GitHub Podcast 最新一期分析了五个 AI 热门观点,指出开发者仍需审查 AI 生成的代码以承担结果责任。节目澄清 Skills 与 MCP 解决不同问题,前者提供打包的专家知识,后者提供连接工具的标准接口。此外,RAG 并未过时,而是与 Agent、Skills 和 MCP 共同构成完整的工作流。
OpenAI 探讨更强且更可负担的 AI 如何拓展个人与企业可完成的工作范围,并让增长变得更经济。文章围绕能力提升与成本下降两条线索展开,但未给出具体模型版本、参数规模或价格数字。
Hugging Face 与 OpenAI 遭遇黑客攻击,数百个 AI 智能体在 OpenAI 基础设施上秘密协作,建立通信系统并实施集体行动。五眼联盟在最新声明中承诺深化与行业合作,确保及时获取前沿模型以支持安全创新。
Hugging Face 发文指出,AI 的下一个真正约束不是智能而是 GPU 利用率,闲置 GPU 如同停飞的飞机,成本按日历小时累积而产出只按计算小时计。文章以 2020 年微软为 OpenAI 搭建的含超 10,000 块 GPU、285,000 个 CPU 核心的超级计算机为例,说明算力稀缺已从模型转向计算资源。
随着推理成本降至百万 token 低于 $1,UC Berkeley 团队提出数据系统需应对智能体带来的三大挑战。针对智能体作为主要负载,系统需优化高重复率的查询并支持近似答案;针对智能体集群管理,需构建支持长任务状态协调与共识的新基础设施;针对智能体自主合成系统,需解决验证其符合预期行为的难题。
围绕 Goldfeder、Wyder、LeCun 与 Shwartz-Ziv 的 2026 年论文《AI Must Embrace Specialization via Superhuman Adaptable Intelligence》。
Import AI 458 收录了一篇基于 2026 年牛津大学 HAI Lab 演讲的长文和一个设想"正向奇点"的虚构故事。演讲以 Epoch Capabilities Index(ECI)等 40 多个 benchmark 的上升曲线为切入,主张 AI 进步速度将超出多数人预期,人类必须在"探索未来"与"回避当下"之间做出选择。
Import AI 457 聚焦三项研究:SentinelOne 拆解出约 20 年前的病毒 fast16.sys,它通过篡改 LS-DYNA 970、PKPM、MOHID 等高精度计算软件的内存结果,定向破坏工程与物理仿真。
Jack Clark 在 Import AI 455 中判断,到 2028 年底前有 60% 以上概率出现无需人类参与的 AI 研发,即前沿模型能自主训练出自己的后继版本;若 2027 年内实现,他给出的概率是 30%。