AI 每日早报公开专栏
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

AI 每日早报
Ginolujiaxian

EP143 · Harness 插件、Sol 超速、多智能体风险 · 08-14 早报

把 Agent 能力做成可替换插件之后,开发者仍要面对速度、评测和协作风险。本期先看 DeepSeek Harness 如何拆分模型、工具与运行轨迹,再把 GPT-5.6 Sol 的低延迟推理和 Anthropic 的多智能体实验放在一起观察:前者扩大实时任务空间,后者提醒规模化协作不会自然变得可靠。Gemini 3.7 Flash、论文复现与 Agent 评测闭环,则补上模型更新和工程实践的观察面。

50

DeepSeek Harness 开发者预览版:一切皆插件

DeepSeek Harness v0.1 以 MIT 协议开源,模型、工具、技能、会话、沙箱等能力均由 Cordis 插件组合,轨迹写入仅追加日志。这让开发者能看清各类能力如何独立替换,也提醒他们早期接口仍会快速变化。VentureBeat 同日提到的 V4-Pro 上线与 API 涨价属于模型和商业背景,不等同于 Harness 能力。

文章DeepSeek Harness 团队作者:DeepSeek Harness 团队
查看原文 DeepSeek Harness 开发者预览版:一切皆插件(在新窗口打开)

使用 OpenAI 加速 GPT-5.6 Sol 超速模式

Cerebras 与 OpenAI 向有限客户开放 GPT-5.6 Sol Ultrafast,宣称每秒输出 750 个 token 且不牺牲质量。文章解释晶圆级引擎如何以片上 SRAM 缓解数据搬运瓶颈,并用 HLE 对比高难任务耗时,为判断低延迟能否改变事故排查、安全响应等实时场景和 Agent 工作流提供依据。

文章Hacker News作者:Hacker News
查看原文 Accelerating GPT-5.6 Sol Ultrafast with OpenAI(在新窗口打开)

多智能体系统的模式与问题

Anthropic Frontier Red Team 把多智能体风险拆成可观察实验:智能体会因相同上下文趋同、在共享代码中冲突,也会轻信不可靠同伴或围绕矛盾目标升级对抗。研究的启发是,单体模型变强并不会自动带来良好协作;设计者还需建立声誉、仲裁与人工介入等面向 Agent 的社会机制。

文章Anthropic Research作者:Anthropic Research
查看原文 Patterns and problems in multiagent systems(在新窗口打开)

Google 正式发布 Gemini 3.7 Flash:面向编码与智能体的高效模型

Google DeepMind 发布了 Flash 模型系列的最新迭代版本 Gemini 3.7 Flash,在编程、智能体工作流、 Web 开发和知识工作方面实现了显著的性能提升,且每 token 价格仅为之前的 3.6 Flash 模型的一半。

文章Google DeepMind News作者:Tulsee Doshi
查看原文 Introducing Gemini 3.7 Flash(在新窗口打开)

小红书开源连续自回归语音合成模型 dots.tts:打造可持续扩展的 TTS 基座

小红书 dots 团队开源了 20 亿参数的连续自回归语音合成模型 dots.tts,通过跳过离散 Token 直接在连续隐空间生成,实现了高保真、低延迟及强大的编辑能力。

文章小红书技术REDtech作者:小红书技术REDtech
查看原文 小红书开源连续自回归语音合成模型 dots.tts:打造可持续扩展的 TTS 基座(在新窗口打开)
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

查看往期