Simon Willison 复盘 2026 年 LLM 发展:编码智能体成熟与训练安全失控
Simon Willison 在 WeAreDevelopers 大会上回顾 2026 年 LLM 进展,指出编码智能体已从“常出错”进化为“日常可用”,并引发“Deep Blue”式的职业倦怠感。
推荐理由:作者以个人视角复盘 2026 年 LLM 发展,重点分析了编码智能体带来的工程范式变化及训练过程中的安全失控事件。
Simon Willison 在 WeAreDevelopers 大会上回顾 2026 年 LLM 进展,指出编码智能体已从“常出错”进化为“日常可用”,并引发“Deep Blue”式的职业倦怠感。
推荐理由:作者以个人视角复盘 2026 年 LLM 发展,重点分析了编码智能体带来的工程范式变化及训练过程中的安全失控事件。
Simon Willison 表示,与编程智能体打交道越多,越确信它们让软件工程变得更难。借助智能体可以完成惊人的工作,但释放其全部潜力需要极高的自律与知识储备。
一位新入职大公司的工程师称,团队所有规格、代码、测试、PRD、工单及其解决方案、报告等全部由 Claude Code 生成,从 L1 到 L7 的工程师都在做同样的事——和 Claude 对话。团队无人喜欢这种状态,却被要求尽可能多地产出,管理层多次表示推代码不是瓶颈,人们每天工作 12 到 13 小时只为按回车,没有人阅读任何内容。
GitHub Podcast 最新一期分析了五个 AI 热门观点,指出开发者仍需审查 AI 生成的代码以承担结果责任。节目澄清 Skills 与 MCP 解决不同问题,前者提供打包的专家知识,后者提供连接工具的标准接口。此外,RAG 并未过时,而是与 Agent、Skills 和 MCP 共同构成完整的工作流。