AI 每日早报公开专栏
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

AI 每日早报
Ginolujiaxian

EP144 · GLM-5.3 安全、循环工程、知识底座 · 08-15 早报

同一套 Agent 工作流,只有把能力、停止条件和组织知识同时说清楚,才可能从演示走向生产。本期从 GLM-5.3 的编程与安全能力出发,继续看如何设计可验证的循环,以及存量团队怎样用知识底座重做协同;其余内容补充开放模型、浏览器自动化和评测陷阱。

50

GLM-5.3:前沿编程能力与涌现的网络安全能力

GLM-5.3 在不更换基座模型的前提下,通过扩大长程任务环境和后训练规模,同时提升编程与网络安全能力。文章既给出终端、软件工程和漏洞评测的分层结果,也说明完整权重将在安全加固后开放,读者可据此区分模型的防御潜力、攻击边界与厂商自测口径。

文章智谱作者:智谱
查看原文 GLM-5.3:前沿编程能力与涌现的网络安全能力(在新窗口打开)

实用循环工程

Addy Osmani 把长时 Agent 工作拆成两种原语:goal 用可测量的完成条件推进有界任务,loop 按时间重复检查外部状态。更关键的经验是让独立 Agent 验证产出,并把审美、架构与安全判断留给人;这为并行代理从演示走向日常工程提供了可复用边界。

文章Elevate作者:Addy Osmani
查看原文 Practical Loop Engineering(在新窗口打开)

重构协同:关于 AI Native 团队的思考

大淘宝技术把 AI 提效停滞归因于协同仍由人串联,而不只是编码速度不够。作者设想以知识底座、分工 Agent 和人形成业务闭环:Agent 执行与传递,人负责目标、判断和例外。对存量团队而言,真正难点是把隐性规则外化,并让知识持续贴近代码、配置与数据等权威来源。

文章大淘宝技术作者:大淘宝技术
查看原文 重构协同:关于 AI Native 团队的思考(在新窗口打开)

开放模型现状:2026 年夏季观察

Hugging Face 的半年期生态报告显示,中国实验室在顶尖开放模型发布上占据主导地位,Qwen 以 151K 个衍生模型成为社区基础模型;报告还首次单列可识别的 Agent 流量,并披露不同编程工具在其中的份额。

文章Hugging Face - Blog作者:Adina Yakefu, Apolinário from multimodal AI art, Irene Solaiman
查看原文 State of Open Models: Summer 2026 Observations(在新窗口打开)

34K Star 的 DeepTutor,不只是 AI 家教:它在做一套 Agent 学习操作系统

本文深度解析开源项目 DeepTutor,揭示其作为 Agent 学习操作系统的核心架构:统一 Agent Loop、RAG、Skills、外部 Agent 与三层长期记忆,实现学习任务的连续性与知识的可复用性,并详细介绍其功能模块、扩展能力与适用场景。

文章山行AI作者:山行AI
查看原文 34K Star 的 DeepTutor,不只是 AI 家教:它在做一套 Agent 学习操作系统(在新窗口打开)
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

查看往期