《AI HOT 速览:Runway 接入 MCP,生成工具继续进入智能体工作流》
本期 AI HOT 以 Runway MCP 服务器为主线,同时记录 Claude Code、实时视频开源项目、隐私分析和本地化语音等进展。值得关注的是,AI 工具正在从单点能力变成可被智能体调用的工作流组件。
🧠 agentic reading|1️⃣ 精准输入
模型、生成与创作工具
Runway 推出 Runway MCP 服务器,让 Claude、ChatGPT、Cursor 等兼容 MCP 的智能体可以在对话界面中直接调用图像和视频生成。该服务器接入 Gen-4.5、Seedance 2.0、GPT Image 2、Kling 3.0、Nano Banana Pro 等模型,面向营销视频、网站视觉素材、角色广告和应用内视觉内容生成。用户通过 runwayml.com/mcp 添加服务器并登录 Runway 账户即可使用,不需要单独 API key。
FastVideo Dreamverse 开源,主打在单张 NVIDIA B200 GPU 和 LTX-2 模型上生成实时视频。项目称7秒可生成30秒1080p视频,定位为“氛围引导”视频生成工具,并提供 GitHub 仓库与发布博客。
Reachy Mini 机器人可通过 speech-to-speech 库实现完全本地语音交互。方案采用级联流水线,并提供兼容 Realtime API 的 WebSocket 接口;默认组件包括 Silero VAD、Parakeet-TDT、Qwen3-TTS,大语言模型推荐用 llama.cpp 运行 Gemma 4。所有数据本地处理,强调隐私和无 API 费用。
编程智能体与开发工作流
Claude Code v2.1.152 发布。/code-review --fix 可以把审查建议直接应用到工作目录;技能与斜杠命令可通过 frontmatter 的 disallowed-tools 移除模型工具;新增 /reload-skills,无需重启会话即可重新扫描技能目录;SessionStart 钩子可返回 reloadSkills: true,并可通过 hookSpecificOutput.sessionTitle 设置会话标题;新增 MessageDisplay 钩子用于变换或隐藏助手消息。其他更新还涉及插件市场管理、主模型不可用时自动切换,以及多项 bug 修复。
OpenAI 相关连接能力继续补齐:团队可以把 MCP 服务器保留在内网,ChatGPT、Codex 和 Responses API 通过仅出站 HTTPS 连接。这个方向降低了企业暴露内网服务的压力,也让内部工具进入智能体工作流更现实。
Kilo Code 支持使用 SuperGrok 或 X Premium+ 订阅,并可尝试 grok-build-0.1,在 Kilo IDE 扩展或 CLI 中获得高速和智能体编程能力。
Perplexity 开源重建的 Unigram 分词器,据称可将 CPU 占用降低5至6倍。对于小型重排序器和嵌入模型,GPU 运行时间只有个位数毫秒,CPU 分词会成为总延迟的重要部分,因此分词器优化直接影响端到端响应速度。
基准测试、研究采用与安全
Artificial Analysis 与 IBM 推出 ITBench-AA SRE 基准,所有前沿大模型得分都未超过50%。Claude Opus 4.7 自适应推理最高为47%,GPT-5.5 xhigh 为46%,Qwen3.7 Max 为42%。该测试包含59个任务,需要模型通过 Shell 调查 Kubernetes 事件快照并提交根因诊断。关键发现是,模型推理轮次差异接近3倍,但更长轨迹不等于更高准确率,过度调查还会因误报受罚。Gemma 4 31B Reasoning 以每任务0.14美元成本取得37%,性价比优于部分闭源模型。
一项面向1260名定量社会科学家的调查显示,81%使用过 AI 聊天机器人,但只有20%常规使用 Claude Code、Codex 等编码智能体。采用率存在差异:男性名字研究者使用率约为女性名字研究者两倍,顶尖大学研究者使用可能性高40%。用户产出更多工作论文和基金申请,但这可能反映早期采用者本身差异。研究者对 AI 辅助可发表论文更乐观,对重塑整个社会科学领域更谨慎。
使用 Claude Opus 进行威胁建模和漏洞发现的最佳实践被总结为六步循环:威胁建模、沙箱隔离、漏洞发现、验证、分类、修复。漏洞发现变得更容易并行化,瓶颈转向验证与处理。截至2026年5月22日,相关开源扫描已披露1596个漏洞,其中97个已修补。指南强调结合代码库文档与专家访谈构建准确威胁模型,以降低误报并提升可利用发现比例。
AI、社会与监管伦理
教皇 Leo XIV 发布通谕 Magnifica Humanitas,警告 AI 的使用不是纯技术问题。当 AI 进入影响人类生活的流程时,它会触及权利、机会、地位与自由。通谕发布时,Anthropic 联合创始人 Christopher Olah 出席,引发科技界内外讨论。
Google Research 推出新的隐私分析方案,结合密码学安全聚合协议和可信执行环境 TEE 的透明性,目标是在零信任原则下只获取群体匿名化聚合洞察。它把密码学与硬件保护结合,用于更强的隐私与安全保证。
Google 搜索产品副总裁 Robby Stein 在 Google I/O 访谈中讨论 Search 向“AI 原生”模式转型。主题包括 AI Mode 是进化还是重塑、复杂问题如何拆成多轮搜索、AI 搜索运行成本、Google TPU 与基础设施优势、AI 时代搜索量为何不减反增,以及高质量 AI 回答与出版商流量之间的张力。核心问题是:如果 Google 直接给答案,传统基于链接的网页生态会走向哪里。
内容生产、产品市场和智能体方法论
guizang-social-card-skill 面向小红书图文常见类别优化,尤其为旅行博主集成地图组件。用户输入目的地和路线后,AI 可自动在底图上标记并嵌入图片。引用称该 Skill 基于 HTML 和实拍图片生成,不会被平台标注为 AI 生成,并会主动寻找高质量主题图片优化排版。
用好 Coding Agent 的关键在初始规划。方法是先整理需求,用最强模型分别在 Codex、Claude Code、Cursor 的 Plan 模式下生成设计方案,选出最优并吸收其他版本。复杂计划可拆成多个 phase,明确要求和验证标准,形成 Markdown 文档;执行时按 phase 推进并人工审核纠偏。最后代码审核用 GPT-5.5 检查代码质量与设计符合度即可。多智能体交叉 review 容易导致代码越改越多,应避免。
Anthropic 与 OpenAI 通过编程智能体找到产品市场契合点,也让企业客户成本明显上升。两家公司在2026年4月前后调整企业套餐定价,从高折扣改为与 API 用量挂钩;Anthropic Enterprise 套餐变为每席位20美元/月外加 API 费用,OpenAI Codex 按 API token 用量计费。同期 GPT-5.5 与 Opus 4.7 的 API 价格也显著高于前代。
结论
当天 AI 热点的主线是:生成工具继续接入智能体协议,编程智能体进入更细的企业工作流,基准测试开始强调真实运维任务与误报成本,AI 搜索和企业定价正在改写互联网与软件商业模式。技术进展很快,但伦理、隐私、成本、验证和生态分配问题也同步变重。
思想框架
这组热点不是单一新闻,而是一张当天 AI 生态切片:上游是模型与生成能力,中游是 MCP、编程智能体和本地机器人,下游是搜索、内容生产、企业定价和社会采用。把它们放在一起看,AI 正从“可演示能力”进入“嵌入工作流后的成本、治理和可靠性竞争”。
建议阅读原文:这篇是中文内容,精准输入只帮助你快速抓住重点,原文的叙事、语气和细节仍值得回读。
AI HOT 日报 · 1 分钟
✍️ think & write|2️⃣ 费曼输出
我的笔记
✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可记笔记
登录后可保存笔记、高亮、划线和批注。