AI 每日早报公开专栏
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

AI 每日早报
Ginolujiaxian

EP107 · 智能体自主性分级、亿级语音 AI、代码廉价化 · 07-04 早报

今天的精讲三条都围绕同一个问题:当模型越来越能干,人和验证该怎么重新摆位。有人给智能体自主性划出六级框架,拆开代理与编排两条轴;有人拆解 OpenAI 支撑 9 亿语音用户的底层架构,看 WebRTC 怎么和 Kubernetes 共处;还有人把 20 天让 AI 提交 70 万行代码的实战,浓缩成一套叫 Harness 的方法论。速览里还有本地 LLM 装机指南、RAG 检索的反共识观点、Fable 5 的网络安全分级,以及几篇讨论 AI 时代工程师角色如何迁移的中文长文。

41

智能体自主性级别

本文跳出 Steve Yegge 的单轴自主性阶梯,改用代理与编排双轴,把智能体自主性划成 Assist 到 Managed-by-exception 六级。作者援引 Anthropic 对约 40 万场 Claude Code 会话的分析——人做约 70% 的规划、模型做约 80% 的执行——指出高自主性不是把人踢出循环,而是从逐步执行转为决定方向。落点是校准式自主:验证永远是瓶颈,每次派发前先立契约(目标、范围、停止条件、证据、预算),并警惕自主性当勋章、许可洗白等四种反模式。

文章Elevate作者:Addy Osmani
查看原文 Agentic Autonomy Levels(在新窗口打开)

OpenAI 如何为 9 亿用户交付低延迟语音 AI

OpenAI 每周为 9 亿用户提供语音 AI,底层走 WebRTC——但 WebRTC 为稳定 IP 设计,与 Kubernetes 可抛弃 Pod 天生冲突,带来端口耗尽与状态粘滞。解法是把协议栈拆两半:边缘无状态 relay 只做包路由,后方有状态 transceiver 持有 ICE/DTLS/SRTP 重状态。关键一招是用握手阶段本就交换的 ICE ufrag 当路由键,relay 从首个 STUN 包读出 ufrag 即可转发,无需热路径查库。团队拒绝 SFU(流量是 1:1)和 TURN(多余往返),用 Go 用户态加 SO_REUSEPORT 扛住了全球实时媒体。

文章ByteByteGo Newsletter作者:ByteByteGo
查看原文 How OpenAI Delivers Low-Latency Voice AI for 900M Users(在新窗口打开)

Code is cheap:AI Native 时代,程序员如何提升五倍 coding 效率

作者以亲测开场:20 天让 AI 提交 70 万行代码、10 个项目并行,由此提出 Harness 方法论——人定方向、模型推进。它直击大模型两个底层事实:概率生成会产出 best-practice slop 式套话,上下文有限带来 Lost-in-the-Middle 式衰减。两件核心武器是水流理论(把控制点上移到边界、checkpoint、风险通道)与最小混沌单元(配 spec、codemap、new-chat 三件套,小到可检查、大到可自治);验收靠五层 safety net,作者甚至一行代码都不看、只盯证据链。

文章阿里云开发者作者:阿里云开发者
查看原文 Code is cheap. Don't write any.——AI Native,程序员如何提升五倍 coding 效率(在新窗口打开)
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

查看往期