AI 每日早报公开专栏
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

AI 每日早报
Ginolujiaxian

EP149 · Kitesurf 执行、SafeChat 分流、仿真校验 · 08-23 早报

浏览器怎么交给 Agent 执行、海量对话怎样把成本压下来、仿真训练的反馈能否相信,这三件事今天都有具体拆解。Cloudflare 讲清 Kitesurf 的边界,DoorDash 展示小模型与 LLM 的分流,仿真一文则提醒:环境生成得再多,也要先验证奖励信号是否可靠。

50

Cloudflare 宣布推出 Kitesurf:面向智能体的浏览器引擎

Cloudflare 的 Kitesurf 把浏览器拆成适合自动化任务的轻量执行层:在隔离的 Workers 环境里运行,兼容 Chrome DevTools Protocol,能接入 Playwright 和 Puppeteer。它更适合截图、HTML 提取这类短任务;视频、WebGL 和长期登录会话仍不在能力范围内。对做 Agent 工具的人来说,这篇把成本、隔离和兼容性的取舍讲得很具体。

文章InfoQ作者:Renato Losio
查看原文 Cloudflare Announces Kitesurf, a Browser Engine for Agents(在新窗口打开)

SafeChat:为实时市场构建可规模化的 AI 安全系统

DoorDash 每天要处理超过 400 万条聊天消息,直接逐条调用 LLM 会碰到延迟和成本问题。他们先用小模型筛掉明显安全的内容,再把不到 10% 的疑难消息交给 LLM 按威胁、辱骂等维度打分,并据此分级处理。更值得参考的是后续的平台化:把模型、条件、回退和回测做成可配置模块,让其他安全或反欺诈场景也能复用这套链路。

文章InfoQ作者:Bruna Pereira
查看原文 SafeChat: Building AI-Powered Safety Systems at Scale in a Real-Time Marketplace(在新窗口打开)

[AINews] 差 10%,便宜 100 倍,快 10000 倍:为什么仿真正在接管

这篇更值得看的部分是对训练环境的拆解:不只合成任务,还要验证任务可解,并在看不到参考答案的前提下生成验证器,再用 oracle、空操作和未解状态测试它。文章把这类闭环放进更长的合成数据脉络中,但对做 Agent 训练的人,具体启发是先把反馈是否可信做扎实;生成再多环境,奖励信号不可靠也难以真正用于训练。

文章Latent.Space作者:Latent.Space
查看原文 [AINews] 10% worse, 100x cheaper, 10000x faster: Why Simulation is taking over(在新窗口打开)

工业具身智能走进工厂,为什么还需要一层「底座」?

埃夫特与启智联合推出智能机器人通用技术底座,通过HALO技能服采集人类原生数据、HumanGPT大模型蒸馏技能、全链路工具链打通开发部署,已在汽车分拣、焊接、喷涂等真实产线验证跨本体、跨工艺的通用化落地能力。

文章机器之心
查看原文 工业具身智能走进工厂,为什么还需要一层「底座」?(在新窗口打开)
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

查看往期