AI 每日早报公开专栏
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

AI 每日早报
Ginolujiaxian

EP149 · Claude 值班、上下文与分工 · 08-19 早报

Claude Tag 已在 Anthropic 的 CI/CD 值班中处理告警、查证并形成态势报告,这篇一手复盘适合关心智能体如何进入生产流程的读者。另外两篇从工程成本和职业分工切入:一篇用实验检验上下文压缩是否真能省 Token,另一篇讨论哪些劳动可以交给 AI,以及人的判断责任该留在哪里。

50

Claude Tag 如何成为 Anthropic CI/CD 故障的第一响应者

Anthropic 的 CI/CD 团队已让 Claude Tag 担任故障第一响应者:它并行查询监控、代码与事故频道,中位 14 分钟给出首份证据分析,最快 4 分钟定位根因。文章还公开了可把团队事故史转成排障流程的工具包,也坦承关键判断仍需人类经验。

文章Claude Blog作者:Claude Blog
查看原文 How Claude Tag serves as Anthropic’s first responder for CI/CD failures | Claude by Anthropic(在新窗口打开)

Agent 的命门是上下文:关键不在少给,而在给对

作者从一笔约 2480 万 Token 的多 Agent 开发账单出发,用对照实验说明:终端输出缩短或代码地图更精简,并不保证整段任务更省。真正可复用的方法,是按阶段给对上下文,把完整证据留在 Artifact,并将状态迁移、路由和去重交给程序。

文章腾讯云开发者作者:腾讯云开发者
查看原文 Agent 的命门是上下文:关键不在少给,而在给对(在新窗口打开)

AI Coding 的共生与替代:一场分阶段的演进

京东技术作者把 AI Coding 分为工具、副驾、协作者与共生体四个阶段,结合团队需求分治流程说明,AI 接管的是可形式化、可检索和可编排的劳动。读者可以用验证成本、红线约束、置信度分流和知识沉淀,重新划分哪些工作交给 AI、哪些判断必须由人承担。

文章京东技术作者:京东技术
查看原文 AI Coding 的共生与替代:一场分阶段的演进(在新窗口打开)

LangSmith 推出可调优的自动评估器

LangSmith 推出 Tuned Evaluators,这是一个托管的低成本 AI 评判器,可自动对生产环境中智能体追踪数据的感知错误进行评分,使团队能够大规模监控和改进对话式智能体。

文章LangChain Blog作者:Jake Broekhuizen
查看原文 Introducing LangSmith Tuned Evaluators(在新窗口打开)

对比与生成:抖音 SOTA 多模态表征模型 DME

字节跳动抖音搜索团队发布多模态表征模型 DME,通过两阶段训练(大规模对比学习+语义充分性学习)引入隐式推理与交叉条件重建机制,在 MMEB-v2 基准上 2B/9B 双量级夺得 SOTA,且仅增加亚毫秒级延迟,已在抖音线上验证 LT 收益 0.1%。

文章字节跳动技术团队
查看原文 对比与生成:抖音 SOTA 多模态表征模型 DME(在新窗口打开)
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

查看往期