EP156 · Jalapeño 实测、Claude 记忆、雷鸟眼镜 · 08-26 早报
本期导语
算力、记忆、终端形态,今天的精讲各走各的路。OpenAI 用 Jalapeño 的首批实测数据说话,每瓦 1.5 到 1.9 倍的吞吐提升把推理成本议题拉回桌面;Claude 把记忆打通到聊天和 Cowork,反复交代背景的负担少了一层;雷鸟创新则在眼镜上做减法,用砍掉摄像头换全天佩戴。三条独立但都够具体,其余 47 条里 LLM 生产前评估与 WebMCP 也值得先看。
本期内容
50 条Jalapeño 首次结果展示 AI 推理领域领先的速度与效率
OpenAI 首颗自研推理芯片 Jalapeño 公布首批实测:在 GPT-OSS 120B、DeepSeek R1、Kimi K2.5 1T 三个公开模型上,每瓦峰值算力提升 1.5 到 1.9 倍,端到端延迟降低 1.7 到 3.6 倍,数据来自 SemiAnalysis 的 InferenceX 公开基准。芯片开发本身也有 AI 参与,从初始设计到流片仅 9 个月,部分 AI 生成算子比人工版本快 1.5 到 1.8 倍。评估推理成本与自研算力成色,可细读附录对比。
Claude 的记忆随处生效,你决定其中包含什么内容 | Claude 由 Anthropic 打造
Anthropic 把 Claude 的记忆打通到 Cowork:日常聊天积累的项目背景,交给云端执行任务时直接可用,反向亦然。记忆更新改为边聊边写入,提到的事下一轮对话即生效,可随时暂停或重置。健康、信仰等敏感主题默认不存储,需手动开启;全部记忆按主题整理,可逐条查看、编辑或删除。对在多个界面切换的用户,省去的是反复交代背景。
对话雷鸟创新李宏伟:智能眼镜的终局仍然是「AI + AR」,AI 是我们现在最重要的事
爱范儿在 iO 眼镜发布前夕专访雷鸟创新 CEO 李宏伟与 AI 负责人程思婕。这款定位「人类增强」的眼镜主动放弃摄像头与大芯片,换取全天佩戴和续航;核心功能全天智记持续记录沟通并生成每日总结。李宏伟判断智能眼镜的「iPhone 时刻」可能要到 2027 年,形态收敛要到 2029 年左右,最难的是第一视角多模态数据。取舍与时间表都给得很实。
一个 Skill 搞定服务重构:从链路分析到测试自动化
本文介绍一种基于渐进式披露和 Harness Engineering 的 Service Refactor Skill,通过五阶段流程标准化服务重构,提升可靠性与可复用性。
Canva 联合创始人 Cliff Obrecht 与 Stripe CEO 对谈:AI 时代的成本结构
Canva 联合创始人 Cliff Obrecht 在这场深度对谈中讨论 AI 时代的设计、产品增长飞轮、全球化组织,以及为何应以快速原型替代冗长规划。
84.49 家央企采买进场,史上最热 WRC:泡沫被挤压,具身行业进入实战阶段
对话 14 年机器人从业者叶阳生,从 WRC 现场观察出发,拆解人形机器人行业从概念展示转向实战落地,破除出货量与预训练神话,给出展台 Demo 鉴别指南与数据底层痛点分析。
如何在生产环境前评估 LLM
本文介绍了一套严谨、面向生产的 LLM 系统评估框架,强调产品决策、集成式测试、贴近生产的数据以及错误分析。
Granite 4.2 LLM:构建方式详解
Granite 4.2 推出了一系列从头开始在 15T 个 token 上训练的密集、仅解码器推理 LLM(3B/8B/30B),采用五阶段预训练、SFT 以及包含用于工具使用的智能体 RL 的多阶段 RL 流程。
用向量搜索设计模式减少 LLM 调用
Raphael De Lio 介绍了语义路由、语义缓存与语义护栏等向量搜索模式,在智能体花费 Token 或调用工具之前减少不必要的 LLM 请求。
用 WebMCP 构建面向智能体的网站
视频介绍了 WebMCP:网站可暴露可发现的工具,让 Codex 更高效地执行操作,并在丰富的交互体验中与人协作。