AI 每日早报公开专栏
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

AI 每日早报
Ginolujiaxian

EP171 · 架构师 Agent、AI 经济情景、RLM 长上下文 · 09-10 早报

架构师 Agent 追溯设计约束,Anthropic 推演 AI 经济,RLM 操作长上下文;据此规划系统、部署与检索。

20

【AI 创新实践】“架构师 Agent” 系统化落地

阿里云开发者基于复杂存量分布式系统的实践,把架构师 Agent 的起点放在技术方案设计:先做需求准入,再按领域组织业务、架构和服务知识,必要时回到代码与配置核验。文章的价值在于把分散在经验和文档中的约束转成可追溯的推理路径,帮助团队讨论 AI 如何参与跨系统设计,同时保留人对关键决策的责任。

文章阿里云开发者
查看原文 【AI 创新实践】“架构师 Agent” 系统化落地(在新窗口打开)

我们经济未来的几种可能

Anthropic 的情景探索器不把 AI 对就业的影响简化为单一结论,而是从任务、采用速度和自主性推演增长、岗位转换与工资分配。它提醒读者把关注点放在增长如何传导给不同群体:即使整体更富裕,知识工作者的岗位与收入路径也可能不同。适合用来审视个人技能与组织部署节奏,而非把预测当成定论。

文章Hacker News
查看原文 Scenarios for our Economic Future(在新窗口打开)

RLM 如何重塑长上下文处理:从 Token 到可执行状态

Kevin Madura 介绍的 RLM 将长上下文保留为 REPL 中可操作对象,让模型编写代码、递归拆分任务,再取回下一步需要的结果。它为文档、日志和大型代码库提供不同于堆叠提示词的思路:给模型可执行环境与目标,让它决定检索、计算和委派路径。对处理密集长输入的团队,这是一条值得评估的工程路线。

视频AI Engineer作者:AI Engineer
查看原文 It’s Tokens All The Way Down: How RLMs are Different — Kevin Madura, AlixPartners(在新窗口打开)

OpenAI 最新争议揭示了数学的未来走向

OpenAI 声称解决了流体动力学中千禧年大奖难题之一,却因涉嫌未经授权使用竞争对手研究人员的工作而引发争议,这凸显了前沿 AI 公司正通过海量计算资源重塑数学研究,同时也引发了关于学术荣誉和人类数学家未来角色的质疑。

文章MIT Technology Review作者:Grace Huckins
查看原文 What OpenAI’s latest controversy tells us about the future of math(在新窗口打开)

#714.Tibo 谈 Codex:harness 总比模型快一步

OpenAI 的 Tibo Sottiaux 详述 Codex 从内部研究项目走向产品的过程:核心用 Rust 编写并全面开源、不绑定自家模型,强调 harness 比模型领先一步并逐渐变薄,以及 AI 正在把 code review 从语法检查推向意图讨论、让代码维护和重构成本大幅下降。

播客跨国串门儿计划
查看原文 #714.Tibo 谈 Codex:harness 总比模型快一步(在新窗口打开)

模型一模一样,Token 却相差 70 倍?三项实测揭开 AI 编程工具的成本黑洞

三项基准测试揭示,即使使用相同模型,不同 AI 编码智能体框架因启动税、缓存利用率和提示词保真度差异,导致 Token 消耗和成本相差数十倍,平台团队应衡量每个经验证结果的成本而非 Token 数量。

文章InfoQ 中文
查看原文 模型一模一样,Token 却相差 70 倍?三项实测揭开 AI 编程工具的成本黑洞(在新窗口打开)

宣布 ADK for Kotlin 1.0:在 Kotlin、Android 及其他领域构建生产级 AI 代理

ADK for Kotlin 1.0 实现了与 ADK 1.0 Core 的完全功能对齐,同时提供了丰富的 Android 首选、本地扩展套件,使开发者能够构建无缝集成云服务和本地硬件能力的生产级 AI 代理。

文章Google Developers Blog作者:Guillaume Laforge
查看原文 Announcing ADK for Kotlin 1.0: Building Production-Ready AI Agents in Kotlin, Android, and Beyond(在新窗口打开)

ARGODRIVE:让 Kimi K3 在苹果芯片电脑从 SSD 流式加载

Deltafin 的一个分支,在配备 128 GB 内存的单个 M5 Max MacBook Pro 上运行完整的 2.8 万亿参数 Kimi K3 MoE 模型,从四块 SSD 流式加载专家权重,实现了约 1.00 token/s 的解码速度,并识别出预填充阶段的低效问题。

文章Hacker News
查看原文 GitHub - argonautlabsai/deltafin: ARGODRIVE Deltafin: Kimi K3 (2.8T MoE) streamed from SSDs on Apple Silicon — fork of gavamedia/deltafin with the ARGODRIVE storage work and benchmark package(在新窗口打开)
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

查看往期