EP141 · 个人 AGI、多模型路由、harness 瘦身 · 08-07 早报
本期导语
如果你正在把 AI 从一次性问答变成可持续工作的系统,本期可以从 Garry Tan 的个人实践清单开始:先积累自己的上下文与 skill,再逐步接入自动化。生产团队则可对照多模型路由的成本、缓存与回退设计,以及 harness 瘦身案例,检查哪些规则已经过期,哪些验收、授权和退出条件必须保留。
本期内容
50 条个人 AGI:掌握上下文、技能与复利式杠杆
Garry Tan 把个人 AGI 落到一套可拥有的基础设施:前沿模型负责智能,个人上下文、记忆与 skill 沉淀独有判断,再由 harness 串起行动。他既给出从小型资料库、首个 skill 到定时任务的实践路径,也提醒认知资产由谁控制将决定杠杆最终属于谁。
多模型路由的现状:为 AI 系统建立生产级控制层
Cognition、NVIDIA 与 OpenRouter 从真实部署约束讨论多模型路由:让前沿模型规划和监督,把执行交给更便宜或更擅长特定任务的模型。圆桌没有把路由简化成选便宜模型,而是展开上下文压缩、缓存、领域判断、回退与控制器设计,适合用来校准生产系统的成本和可靠性权衡。
模型越来越强, harness 该留下什么?
腾讯云开发者用团队 harness 大幅瘦身的实践追问:模型变强后,哪些脚手架已从帮助变成干扰。文章给出的分界很实用——补模型能力缺口的规则会过期,组织验收、授权边界和私有流程不会;路径可以放开,但验证证据与退出条件必须收紧,可直接作为下一轮指令审计的框架。
AI 模型在飓风预测方面实现突破
Google DeepMind 的 WeatherNext AI 模型提供额外一天的飓风预测提前时间,相当于十年气象进步,现已在 Nature 发表并开源。
Linux 内核藏了 18 年的漏洞,这次 AI 比所有人先找到
本文详细披露了 TencentOS 安全团队自研的 AI 智能体「科维斯 AI」发现并利用 Linux 内核 SCTP 协议栈中一个潜伏 18 年的 0day 漏洞(CVE-2026-64564)的全过程,展示了 AI 在真实复杂内核安全研究中的能力。
从问到做:世界如何将 ChatGPT 投入实际工作
OpenAI 首次发布按国家统计的 ChatGPT 使用数据,显示 AI 采用正从“提问”转向“做事”,其中工作场景下的任务完成、多媒体使用以及 35 岁以上用户的增长在全球范围内最为迅速。
具身智能的 ChatGPT 时刻!上海创智学院团队开源了
上海创智学院邱锡鹏团队提出具身任务智能体(ETA)范式并开源 OpenETA 框架,主张通过模型-工具-运行时-环境回执的可信闭环解决具身智能落地难题,在 LIBERO 基准上验证了范式有效性。
运行时无关的 AI 工作流:面向生产耐久性与快速评估迭代的模式
本文介绍了 Brex 采用的一种运行时无关的编排模式,使同一套 AI 工作流逻辑无需修改即可在生产环境(Temporal)和快速离线评估中运行,从架构上消除评估与生产之间的偏差。
从混乱到秩序:我如何搭建一套「规范驱动」的 AI 协作开发体系
vivo 技术团队分享其自建的「OpenSpec 规范层 + AI Workflows 执行层」AI 协作开发体系,通过「规范+技能+钩子」机制系统化解决存量项目增量开发中 AI 理解偏差、执行不稳、重复造轮子等痛点,并附完整实战案例与两周落地指南。
杜克大学周忆粟:AI 来了,年轻人的梯子被抽掉了
社会学家周忆粟与徐文浩深度对谈 AI 对教育的冲击:学习中的必要摩擦被 AI 填平,初级岗位的晋升阶梯被技术抽离,高等教育正被迫从结果导向转向具身性与过程导向的评估变革。