AI 每日早报公开专栏
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

AI 每日早报
Ginolujiaxian

EP112 · GPT-Live、Grok 4.5、本地模型编程 · 07-09 早报

语音模型、编码模型和本地小模型,今天的三条精讲都在回答同一个问题:AI 能不能更自然地进入真实工作流。GPT-Live 关注实时对话里的连续交互,Grok 4.5 关注长任务和工具使用,本地模型实验则提醒我们,落地效果仍取决于任务边界、Harness 和人工审查。

43

OpenAI 发布全双工语音模型 GPT-Live

OpenAI 的 GPT-Live 把语音交互从轮流说话推进到全双工架构:模型可以边听边说、在需要时保持沉默或打断,同时把搜索、推理和更复杂的任务交给后台前沿模型处理。它不只是一次语音体验更新,也是在把实时对话和更长程的 Agent 工作流接起来。

文章OpenAI News作者:OpenAI
查看原文 Introducing GPT-Live(在新窗口打开)

Cursor 发布面向长任务的 Grok 4.5

Cursor 与 SpaceXAI 发布 Grok 4.5,重点不只是模型进入 Cursor,而是训练目标从纯软件工程扩展到数据科学、金融、法律等更宽的知识工作。文章还披露了用分布式 Agent 系统构造困难环境、通过强化学习训练长任务能力的路线,适合观察 AI coding 工具如何走向通用电脑工作。

文章Cursor Blog作者:Cursor Team
查看原文 Introducing Grok 4.5 · Cursor(在新窗口打开)

本地模型用于编程的经验

这篇发布在 Martin Fowler 站点的文章作者是 Birgitta Böckeler。她用本地小模型做 Agentic coding 实验,按内存、速度、工具调用、功能正确性、上下文延续和代码质量建立可行性漏斗。结论很克制:本地模型还远不能替代大模型,但在小而明确、文件范围清楚的任务上已经能进入真实工作流。

文章Martin Fowler作者:Martin Fowler
查看原文 Experiences with local models for coding(在新窗口打开)

Meta 推出智能体图像模型 Muse Image 和视频模型 Muse Video

Meta 推出 Muse Image,这是一个具备智能体能力的图像生成模型,能够使用工具、自我优化以及测试时计算扩展,同时预览了 Muse Video(一款支持原生音频的视频生成模型),现已可在 Meta AI、Instagram Stories 和 WhatsApp 中使用。

文章AI at Meta Blog
查看原文 Introducing Muse Image and Muse Video(在新窗口打开)
登录后订阅

登录后会回到本专栏。公开期次现在即可阅读。

查看往期