《AI HOT 日报:LOGOS 开源,科学大模型和多模态应用继续加速》
本期 AI HOT 记录了统一科学大模型 LOGOS 开源、语音与图像模型进展、代码和医疗场景更新,以及企业 AI 投资回报和隐私风险讨论。它适合用来快速扫描 AI 从模型能力到产品治理的当天变化。
🧠 agentic reading|1️⃣ 精准输入
导语
这期 AI HOT 是一组 2026-06-19 的 AI 信息流,核心不是单一观点,而是把科学大模型、实时语音、医疗问答、图像与创意工具、开发者工作流、自动驾驶监管、前沿实验室人事、电力基础设施、内容安全、机器人、隐私、罕见病诊断、模型对齐、智能体基准、Claude Code 指令体系、PEFT 微调和企业 AI 投资回报放在同一张地图里。按固定来源规则,处理这类日报时不能只挑几条,而要尽量保留当天热点的完整轮廓。
1. 模型能力与科学、医疗、多模态应用
1.1 LOGOS 开源和实时语音模型上线
- LOGOS 由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源,被描述为首个基于统一“科学语法”的多领域科学生成基础模型。LOGOS-1B 只有 1B 参数,却在六大科学任务中匹配或超越专用方法:口袋条件配体生成首次以纯序列范式超过 3D 扩散模型并超过 NatureLM(8×7B),逆合成预测 Top-1 准确率 74.8%,口袋位点识别仅靠序列达到 58.5% Top-n 准确率,MOF 材料生成 NBB 提升到 17.78%。它用统一词汇表把蛋白质、小分子等编码为离散 Token,通过空间交互离散化,在无需 3D 坐标的情况下做序列预测,并已开源权重、推理代码和技术报告。
- 火山引擎上线豆包实时语音模型 3.0(Seeduplex)API 并开启邀测。它是原生全双工端到端语音模型,强调精准遵循、抗干扰和动态判停:能在多人对话中等待指定话题再加入,支持在实时交互中调用工具预定日历、发送邮件;判停延迟缩短约 250ms,复杂场景抢话比例下降 40%,用户主动打断延迟缩短约 300ms,面向汽车座舱、智能硬件和客服。
我的笔记
✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可记笔记
登录后可保存笔记、高亮、划线和批注。