EP175 · AI 选择效应、Bending Spoons、Antspace · 09-14 早报
本期导语
看 AI 采用数据先想选择效应;Bending Spoons 示范选人,Claude 底层藏着 Antspace。
本期内容
20 条你的 AI 采用提升是选择效应
作者是一位专注因果推断的 Staff Data Scientist,用 4 万个模拟 B2B 账户演示:采用 AI 助手的账户留存高出 15.4 个百分点,而真实效应只有 4 个百分点,其余都是选择效应——越投入的账户越爱开新功能。他的建议是把分析放到客户没得选的变异上,比如上线时的席位资格门槛。文章据此做断点回归,估出 +4.9 个百分点,并给出带宽、安慰剂、门槛操纵等六项诊断,代码和 notebook 全部开源可跑。
走进 Bending Spoons:人才、AI 与卓越运营 | Luca Ferrari
David Senra 对谈 Bending Spoons 联创 Luca Ferrari,讲这家买下并长期运营 Evernote 的公司如何运作:上一年收到约 80 万份申请、录用不到 300 人,招聘决策集中到总部且不给招聘经理个人奖金;让有潜力的人背上超负荷任务来训练判断力;50 多个自研工具把被收购业务接进同一套内部操作系统。Evernote 被收购后从约 350 人缩到 50-60 人,产品迭代速度反而至少快三倍。他强调效率不是目的,把业务做好才是。
逆向 Claude Code 运行时:在 Anthropic 内部发现隐藏的 PaaS Antspace
作者在自己的 Claude Code Web 会话里顺手 strace 了 PID 1,结果挖出 Anthropic 未公开的基础设施:运行环境是 Firecracker MicroVM(与 AWS Lambda 同源),环境里 27MB 的 Go 二进制未做 strip、带完整调试符号,包结构和依赖一览无余。顺着符号继续挖,发现了 Antspace——一个全网检索为零的应用托管平台,claude.ai 的 Baku 构建器默认部署目标就是它而非 Vercel。全文只用 strace、objdump 等标准工具完成,作者判断这是一套垂直整合的 AI 原生 PaaS 架构,是否公开发布还需观察。
当具身智能走到十字路口|对谈苏度、蚂蚁灵波、自变量、破壳:四种一线判断
四位具身智能一线创业者与研究者围绕数据来源、模型路线与商业化指标展开公开分歧讨论,认为物理接触能力是当前瓶颈,客户可持续付费才是产业化的终极信号。
左手推理成本暴降 96%,右手性能反超大模型!当小模型学会了何时求助
PyroDash 是一种成本感知、token 级的协同推理范式,通过训练小模型在生成过程中主动识别能力边界并请求大模型接力,实现了在五个数学基准上平均 96% 的成本降低,同时在高准确度模式下性能反超纯大模型。
GPT-Live 1 正式登陆 API:面向自然全双工对话的语音模型
OpenAI 在 API 中推出 GPT-Live 1,这是一款可在打断和背景噪声中保持自然对话的全双工语音模型,并将推理与工具调用交由独立的后端模型处理。
HuggingFace 智能体训练全流程公开课
HuggingFace 推出一个六讲的智能体训练 workshop,从评估、强化学习、微调到部署,提供完整的后训练路线。开源项目包含可执行代码,并揭示了该领域中的关键实验设计——例如隔离评估与训练数据,以及使用可验证的奖励函数来判断一个 setup 是否有效。
腾讯回到主场
本文深度解析了腾讯如何利用其在连接、开放与生态方面的传统优势,通过 WorkBuddy 等产品将 AI 从单纯的助手转化为能够调度各类能力、连接第三方生态并深入企业业务流程的 Agent 平台。
营销运营即代码:在 GitHub 上实现从活动策划到后续跟进的全流程自动化
作者展示了如何将 GitHub 基础能力与 GitHub Copilot 智能体技能相结合,实现「营销运营即代码」,将营销活动工作流从策划到活动后报告全流程自动化。
开源项目为 Apple Silicon 带来完整的 iOS 27 虚拟化体验
一款名为 vphone‑cli 的开源工具利用 Apple 的 Virtualization.framework,让开发者能够在 Apple Silicon 上运行完整的 iOS 27 虚拟机,从而实现超越 iOS 模拟器的安全研究与测试。