《AI HOT 日报 · 2026-05-23 — 首个基于华为昇腾910B NPU全栈训练的1.58比特开源大模型BitCPM-CANN发布》
1. 中国团队发布了BitCPM-CANN,这是第一个完全在华为昇腾910B NPU上训练的开源1.58比特三元大模型,内存占用比BF16小约6倍,能在边缘设备高效部署并保持95-97%性能。 2. 谷歌推出面向AI代理的完整工具链(Antigravity 2.0、Gemini API、WebMCP等),加速代理开发、部署与网页/Chrome集成。 3. 多项研究和项目显示AI在安全检测、形式化证明、实时视觉评估与代码自动化等领域取得突破,同时大规模融资与产品化推进加速产业化。
🧠 agentic reading|1️⃣ 精准输入
这期 AI HOT 是一组当天 AI 进展速览,重点集中在国产低比特大模型、Google 代理工具链、安全与形式化证明、视觉评估、代码自动化、融资和产品化。它的价值不是单点深读,而是帮助读者扫到当天技术和产业的几个方向。
模型与硬件:BitCPM-CANN 的国产栈信号
最值得标出的新闻是中国团队发布 BitCPM-CANN。它被描述为首个完全在华为昇腾 910B NPU 上训练的开源 1.58 比特三元大模型。低比特模型的关键意义在于内存占用:报道称其内存占用比 BF16 小约 6 倍,同时在边缘设备上可高效部署,并保持约 95%-97% 性能。
这条新闻的重点不是“又一个开源模型”,而是训练、量化、部署和国产硬件栈之间开始形成闭环。 如果低比特训练和推理能稳定落在 NPU 生态上,边缘设备和本地化部署就会有更现实的成本优势。
Beta Free
注册芝士内参,免费阅读全部文章
内测期全部免费开放,正式版 ¥9.9/月 · ¥99/年。
我的笔记
✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可记笔记
登录后可保存笔记、高亮、划线和批注。