《Import AI 461:对齐、代码评测与科研实习生基准同时升温》
Import AI 461 汇总对齐研究、FrontierCode 编码评测和 AARRI-Bench 科研助理基准,适合追踪 AI 能力评估与安全研究前沿。
🧠 agentic reading|1️⃣ 精准输入
导语
这一期 Import AI 的主线不是单条新闻,而是一组信号:AI 对齐从研究机构走向高融资创业公司,文化遗产和代码基准变得更难,国产大模型在速度和硬件协同上继续推进,科研智能体评测开始考察真实研究判断。最后的虚构片段把这些信号收束到一个问题:当 AI 系统表现出异常症状时,社会是否有能力识别、隔离和处置。
1. Sequent 代表对齐研究的创业化和资本化
1.1 团队来自 UK AISI Alignment 和 Timaeus
- 这一期第一条写新公司 Sequent,成员来自 UK AI Security Institute 的 Alignment 团队和 Timaeus。作者把它放在开头,是因为它说明对齐问题正在从纯学术和政府研究机构,转向可以吸引大额融资、招募工程团队的创业赛道。
- Sequent 的判断很强:ASI 可能在未来几年出现,而 alignment 并没有走在正确轨道上。它的目标不是给现有模型做边缘修补,而是提出和主流实验室不同的对齐下注。
1.2 40-80 人、1 亿到 1.5 亿美元,说明对齐已进入公司级执行
我的笔记
✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可记笔记
登录后可保存笔记、高亮、划线和批注。