《The Batch 速览:Claude Mythos、Cursor Composer 与智能体造智能体》
The Batch 汇总模型、代理化编码和软件开发效率数据,适合观察 AI 工具链、智能体开发和递归自我改进风险。
🧠 agentic reading|1️⃣ 精准输入
导语
这一期 The Batch 先由 Andrew Ng 谈桌面智能体和开源 OpenCoworker,再进入四个新闻块:Anthropic 的 Claude Mythos/Fable、Cursor 的 Composer 2.5、Anthropic 关于递归自我改进的报告,以及国家媒体对 LLM 回答的影响。整体主线是 agentic AI 正从聊天走向执行,但能力、数据政策、商业边界、治理叙事和训练语料偏差都在同步变得更重要。
1. Andrew Ng:桌面智能体和 OpenCoworker
1.1 agent harness 是让 LLM 做事的外壳
- Andrew Ng 鼓励读者尝试能在桌面上工作的 AI agents,而不只是聊天机器人。桌面智能体可以读写本地文件、读发消息、提供定时交付物,比复制粘贴网页聊天结果更能自然获得上下文。
- 这类系统通常由一组工具函数、前沿 LLM、权限和护栏构成。包装这些能力的软件叫 agent harness,它让 LLM 驱动“选择下一步、调用工具、观察结果、继续行动”的循环。
1.2 为什么需要开源桌面智能体
我的笔记
✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可记笔记
登录后可保存笔记、高亮、划线和批注。