跳到主要内容
读
读见
BestBlogs 出品
发现专栏
订阅更新
我的专栏
登录
公开专栏
日报
AI 每日早报
从近期的 AI 产品、研究与行业进展中,挑出值得关注的内容,帮你判断什么值得继续深入。
主理人
Gino
lujiaxian
最近更新:
2026年9月16日
更新节奏:日报
登录后订阅
登录后会回到本专栏。公开期次现在即可阅读。
正在载入专栏期次
首页
发现
更新
我的
历史期次
共 66 期公开内容
EP157 · 智能体隔离、智能体 SaaS、AI 市场格局 · 08-27 早报
连续几期讨论围栏、运行时与上线前评测之后,OpenAI 披露的 Hugging Face 事件给出了一次可复盘的失控样本。另两篇分别提供产品和市场视角:SaaS 如何借托管 MCP 服务人和智能体,以及模型分化、应用护城河与消费市场为何仍需分开判断。
2026年8月27日
EP156 · Jalapeño 实测、Claude 记忆、雷鸟眼镜 · 08-26 早报
算力、记忆、终端形态,今天的精讲各走各的路。OpenAI 用 Jalapeño 的首批实测数据说话,每瓦 1.5 到 1.9 倍的吞吐提升把推理成本议题拉回桌面;Claude 把记忆打通到聊天和 Cowork,反复交代背景的负担少了一层;雷鸟创新则在眼镜上做减法,用砍掉摄像头换全天佩戴。三条独立但都够具体,其余 47 条里 LLM 生产前评估与 WebMCP 也值得先看。
2026年8月26日
EP155 · 环境验证、Agent 围栏、AI 工程技能 · 08-25 早报
当代码生成越来越快,真正拖慢交付的往往是环境、验证和组织规则。本期从大淘宝的研发链路复盘出发,对照 Steve Yegge 的多 Agent 治理实验与吴恩达的 AI 工程技能图谱,看看团队该把投入从提示词编排转向哪些可积累的工程能力。
2026年8月25日
EP154 · OpenAI 押注、847 病历、Agent 安全 · 08-24 早报
Sam Altman 在 Founders 访谈里讲 OpenAI 早期的节奏:成立四年半才发布第一款产品,没有用户信号时怎么判断方向,以及为什么砍掉 Sora 和 Atlas,把算力转投 Codex。本期另外两条精讲是 847 份生产临床 AI 病历的审计发现和 NVIDIA 的 Agent 安全分层建议。想看研究型组织怎么定节奏、真实系统里怎么找出看似正常的错误,这期都有具体材料,快讯含 GPT-6 停训等七条动态。
2026年8月24日
EP149 · Kitesurf 执行、SafeChat 分流、仿真校验 · 08-23 早报
浏览器怎么交给 Agent 执行、海量对话怎样把成本压下来、仿真训练的反馈能否相信,这三件事今天都有具体拆解。Cloudflare 讲清 Kitesurf 的边界,DoorDash 展示小模型与 LLM 的分流,仿真一文则提醒:环境生成得再多,也要先验证奖励信号是否可靠。
2026年8月23日
EP152 · SDLC 重构、多模态 API、设计品味 · 08-22 早报
代码生成提速以后,团队接下来要改的不只模型。Anthropic 给出重组计划、评审与部署的 SDLC 方法,DeepSeek 带来可直接接入的多模态 API,Hassan El Mghari 则示范如何把设计偏好写成 Agent 可执行的上下文。后续还可沿着企业软件工厂、推理降本与评测偏差继续读。
2026年8月22日
EP151 · 搜索语义表征、Token 分工、数据评测产品 · 08-21 早报
美团搜索三期实践给出一条很实在的表征工程路径:难负样本、简化 Prompt、覆盖率与统计特征,哪个环节都不能省。另一边,硅谷 101 讨论本地开源模型和云端前沿模型如何按任务分工,YC Paper Club 则把数据、环境和评测当作持续维护的产品。三篇分别适合排序工程、Agent 成本和评测体系的读者进入。
2026年8月21日
EP150 · DevTools 判断、专家治理、17 岁 ICML · 08-20 早报
Addy Osmani 把 Chrome DevTools 的经验接到 agent 循环上,问的是判断会不会被交出去。Rachel Laycock 则把周末能跑起来的应用,和能进生产的软件分开。中间夹着一位 17 岁作者刚被 ICML 接收的预训练论文。三条各自成立,不必合成一条主线,读者可以按需要选入口。
2026年8月20日
EP149 · Claude 值班、上下文与分工 · 08-19 早报
Claude Tag 已在 Anthropic 的 CI/CD 值班中处理告警、查证并形成态势报告,这篇一手复盘适合关心智能体如何进入生产流程的读者。另外两篇从工程成本和职业分工切入:一篇用实验检验上下文压缩是否真能省 Token,另一篇讨论哪些劳动可以交给 AI,以及人的判断责任该留在哪里。
2026年8月19日
EP148 · 语义层 / Agent Commerce / AI 工程 · 08-18 早报
从企业数据的语义层,到可交易的智能体与更高效的 AI 集群,本期关注的是让模型能力真正进入生产系统时必须补上的结构、约束与基础设施。它们并非同一类产品问题,却共同提醒我们:可靠性来自可解释的流程与可验证的工程边界。
2026年8月18日
EP146 · 设计师焦虑、持久化知识层、实体自动化 · 08-17 早报
Lenny 的职场情绪调研里,设计师和用研在各维度都最不快乐。OpenAI 产品设计负责人 Ian Silber 把焦虑归因于角色期望不清:工程师生产力提升 10 倍乃至 100 倍,设计的反馈与对齐却省不掉,他却认为这是做设计师的好时机。另外两篇精讲各自独立:一篇为 RAG 系统设计持久化知识层,把文档矛盾建成显式对象;一篇是 Travis Kalanick 长访谈,从与滴滴的补贴战谈到做专用机器人。其余 Qwen 3.8 27B、Claude 文本水印等内容可按需选读。
2026年8月17日
EP145 · 防蒸馏旁路、Harness 世界观、Flue · 08-16 早报
今天的精讲从一篇 116 页论文开始:三家顶尖模型的加密推理包被注入同厂轻量模型后,隐藏思维链可被逐字转录。腾讯科技把 DeepSeek Harness 放进递归自我改进的研究脉络,读得出与插件介绍不同的增量。Astro 创始人的 Flue 把 React Hook 带进智能体开发,适合想动手的读者。
2026年8月16日
EP144 · GLM-5.3 安全、循环工程、知识底座 · 08-15 早报
同一套 Agent 工作流,只有把能力、停止条件和组织知识同时说清楚,才可能从演示走向生产。本期从 GLM-5.3 的编程与安全能力出发,继续看如何设计可验证的循环,以及存量团队怎样用知识底座重做协同;其余内容补充开放模型、浏览器自动化和评测陷阱。
2026年8月15日
EP143 · Harness 插件、Sol 超速、多智能体风险 · 08-14 早报
把 Agent 能力做成可替换插件之后,开发者仍要面对速度、评测和协作风险。本期先看 DeepSeek Harness 如何拆分模型、工具与运行轨迹,再把 GPT-5.6 Sol 的低延迟推理和 Anthropic 的多智能体实验放在一起观察:前者扩大实时任务空间,后者提醒规模化协作不会自然变得可靠。Gemini 3.7 Flash、论文复现与 Agent 评测闭环,则补上模型更新和工程实践的观察面。
2026年8月14日
EP147 · Grok 4.6、可靠性交付、WorkBuddy 实操 · 08-13 早报
Grok 4.6 的发布把长时任务能力放进了真实的开发工具里,但模型能做得更多,并不自动等于团队可以少做验证。Charity Majors 从可观测性谈信任条件,WorkBuddy 的长指南则把办公智能体落到权限、技能和具体操作。其余文章继续补上记忆、机器人、企业交付与开源模型的实践线索。
2026年8月13日
EP146 · 阿里开源复盘、专用执行模型、Switchyard · 08-12 早报
一个开源项目如何在两个月内获得 20k star,阿里团队给出的答案落在开发、评审、发版与社区响应的具体流程上。本期另外两篇适合对照着读:NVIDIA 提供专用执行小模型,LangChain 则用真实任务测算何时值得路由到前沿模型,并明确成本、准确率与延迟之间的取舍。
2026年8月12日
EP145 · OpenClaw 实战、人本 AI、多模型网关 · 08-11 早报
把智能体放进真实世界,难点很快从模型能力转向权限、验证与维护。OpenClaw 的爆红复盘提供一线工程经验;李飞飞提醒我们用能动性与尊严衡量 AI 的价值;OpenRouter 则把多模型选择落到质量、成本和数据边界的动态权衡。三篇适合分别从系统实践、人本尺度和技术采购读起。
2026年8月11日
EP143 · 代码质量门禁、H3 视频架构、软件新原语 · 08-09 早报
当智能体每天生成海量改动,审查注意力该放在哪里,比逐行检查更值得先回答。本期先看类型、测试与安全扫描如何组成代码门禁,再核对 H3 视频模型的架构、内存门槛与已知限制。最后借 Daily 的多人游戏实验,看看长期子智能体和动态界面如何成为聊天框之外的软件原语。
2026年8月9日
EP142 · 贾扬清再创业、淘宝主播 Agent 骨架、田渊栋谈递归自进化 · 08-08 早报
贾扬清刚官宣第二家创业公司 Intent Lab,上一家 Lepton AI 第二年盈利后被英伟达收购;这期串台声东击西,他回溯从读研时做出 Caffe 到走过 Google Brain、Meta 与阿里的完整路径。另两篇精讲偏工程与研究:大淘宝技术详解直播主播 Agent 的 Harness 骨架,面向真金白银的直播场景;田渊栋在晚点聊里讲清 RSI 递归自进化的核心悬念。其余精选可关注 Cursor 重写 GPU 与字节 5 万亿参数讨论。
2026年8月8日
EP141 · 个人 AGI、多模型路由、harness 瘦身 · 08-07 早报
如果你正在把 AI 从一次性问答变成可持续工作的系统,本期可以从 Garry Tan 的个人实践清单开始:先积累自己的上下文与 skill,再逐步接入自动化。生产团队则可对照多模型路由的成本、缓存与回退设计,以及 harness 瘦身案例,检查哪些规则已经过期,哪些验收、授权和退出条件必须保留。
2026年8月7日
上一页
第 2 页
下一页