EP177 · 可验证安全、实时语音、上线排障 · 09-16 早报
本期导语
黄仁勋把 AI 安全落到验证机制,Gemini 3.8 Live 展示实时协作,Plivo 的故障清单给出上线排障路径。
本期内容
20 条英伟达 CEO 黄仁勋谈 AI 安全、开放模型与赢得 AI 竞赛
黄仁勋把安全讨论拉回可验证的工程控制:他主张先追溯前沿实验室的具体事故、建立测试与独立评估,再决定监管如何介入;对递归自我改进,也强调产品发布前仍须经过验证与评测。对中文读者而言,值得借此区分风险叙事、治理机制与开放模型的产业选择,观察算力、应用和生态如何共同决定竞争力。
Gemini 3.8 Live 发布:实时多模态与 Extended Thinking 双版本
Google DeepMind 发布的 Gemini 3.8 Live 将实时视觉理解、跨语言对话与后台工具调用放进同一语音交互链路;Extended Thinking 则在持续对话中处理更复杂的多步骤任务。文章同时给出开发者、企业与产品用户的上线入口,并以音频水印回应可识别性问题。它提供了观察语音智能体从演示走向工作流协作的一组具体能力边界。
上线第一周就会撞上的 5 种语音智能体失败模式 — Venky B,Plivo
Plivo 基于长期语音 API 和真实生产呼叫经验,拆解语音智能体首周常见的延迟、转写、结构化采集、语音合成及轮次交互问题。最可迁移的经验是把自由文本改为带约束的字段和字段级评测,并在转写与合成之间加入可控的规范化层。对正在做语音产品的团队,这份清单可用来把 PoC 指标转成上线后的排障与验收项。
Tobi Lütke:工作的未来、AI 智能体与人类判断力
Shopify CEO Tobi Lütke 向 Shane Parrish 讲述,像 River 这类带人格的智能体如何驱动 Shopify 大量工程工作,为何机器仍无法为艰难决策承担责任,以及品味、慢反馈直觉、修剪与长寿机构如何塑造他做产品与建公司的方式。
你的智能体出色完成了任务。它还能再来一次吗?
文章介绍了一套诊断与指南系统,用于衡量并将 LLM 智能体的平均准确率与单任务可靠性之间的一致性差距减半,同时不降低平均性能。
Aaron Levie:重塑 Box,押注 AI 时代的应用层
Box CEO Aaron Levie 指出,前沿模型与企业工作流之间鸿沟巨大,应用层智能体、harness 和变革管理将拿走万亿级价值,编码之外的 AI 扩散会比硅谷预期慢得多。
智能的下一幕,让人兴奋——73 页 PPT solo
庄明浩以 73 页 PPT 单口梳理过去一个季度 AI 行业,从模型狂奔、智能分化、循环自生到界面重构四个章节,论证正从模型竞争转向「拥有自己的智能」。
iOS 27 正式版体验:Siri AI 终于开窍了,老 iPhone 升级也有新东西
iOS 27 正式版推送,新一代 Siri AI 支持屏幕感知与跨 App 复合指令,但国行暂未开放;系统在液态玻璃调节、动效调度、调休闹钟等日常细节上做了大量填坑。
AI 开始预测人类:83 亿虚拟人格、数字社会,与一门押注未来的生意
文章探讨AI模拟技术如何构建虚拟人格与社会,分析其商业模式、技术挑战及哲学意义。
从担心 AI 失控到 AI 造福人类:比尔盖茨怎么想|对话盖茨
比尔·盖茨在访谈中讨论了盖茨基金会如何应对 AI 风险,通过解决语言障碍、本地化适配及人才培养,确保 AI 技术能惠及全球南方并缩小贫富差距。