EP93 · 限研争议、应用攻防、工程再思 · 06-20 早报
本期导语
Anthropic 限制竞品研究、Fable 被迫全球下线,AI 主权与公平竞争的矛盾摆上桌面,Nvidia 与新基准证明智能体编程远未触顶。一场实测演讲层层攻破 LLM 应用护栏,提醒最小权限才是真正防线。还有人断言:软件工程 50 年从未真正工程化,程序员要从人肉编译器转型为产线设计师。
本期内容
23 条测试神话与寓言,超越 SWE-bench,Nvidia 的开放竞争者
Andrew Ng 罕见动怒:Anthropic 不仅给 Claude Fable 5 加上限制竞品研究的条款,还被曝悄悄降低疑似同行研究者的输出质量;美国商务部出口管制更直接逼得 Fable 全球下线,掀起多国关于 AI 主权的讨论。同期 DeepSWE 等新基准证明智能体编程能力远未触顶,Nvidia 也以混合架构悄然加入开源模型竞速。
攻破 LLM 驱动的应用:从上下文投毒、工具越权到纵深防御
Spring I/O 演讲实测攻破 LLM 应用:用路径穿越污染 RAG 知识库让助手认账虚构条款,靠 SQL 注入伪造聊天记忆诱导越权操作,再用拆分提问绕过护栏套取用户数据;核心结论是护栏只能降风险,授权、最小权限工具与可观测性才是真正防线。
AI 革命新思考:过去 50 年,软件工程其实没真正「工程化」过?
作者提出尖锐论断:过去 50 年软件工程靠人脑堆代码,从未真正工程化;大模型第一次实现耗能换高阶认知,但范式必须从人为中心 + AI 辅助转向 AI 为中心,否则不确定性会在人机之间循环放大——程序员将从人肉编译器转型为产线设计师与偏差拉回者。
Project Valhalla 详解:十年磨一剑,JDK 28 预览版终登场 - JVM Weekly vol. 180
Project Valhalla 的值类终于在 JDK 28 预览版中落地,经过十年的设计迭代和方案否决,为用户自定义类型带来了扁平、紧凑的内存布局。
Andrew Ng 论 AI 控制:Anthropic 与美国政府行动标志着转折点
Andrew Ng 分析了 Anthropic 与美国政府近期限制前沿 AI 模型访问的行动,认为这些举措正加速全球对 AI 主权和开源替代方案的投资。
为敏感云系统设计持续授权
本文主张,在云系统中,授权必须从单一的登录时决策转变为对每个敏感操作的持续、上下文感知评估,并提供了实现这一目标的实用架构。
TypeScript 7.0 RC 发布,编译器移植 Go 实现 10 倍提速
TypeScript 7.0 RC 发布,该版本将编译器从 TypeScript 完整移植到 Go,实现了约 10 倍的性能提升,同时引入了新的并行化控制、重构的监视模式以及更新的默认配置。
暗物质探索迎来全新局面
WIMP 暗物质搜寻的失败,为轴子、低质量粒子、量子传感器乃至行星极光等大量新候选体和探测方法打开了大门。
谁在 ChatGPT 上投广告?ChatGPT 和 Claude 又在哪投广告?
本文基于 Sensor Tower 2026 年 AI 报告,梳理了 ChatGPT 广告系统、10 亿月活里程碑、Claude 高 ARPU、AI 厂商广告投放策略分化、GEO 对零售的影响以及赛道格局固化等关键趋势。
两个 80 后,在硅谷「崩老头」
本文从谷歌面临AI搜索颠覆的「创新者窘境」切入,深入剖析大模型商业模式的根本矛盾——推理成本高企与订阅收入难以覆盖的剪刀差,并指出AI产业的真正赢家是基础设施层,而非模型层。