斯坦福博士生 Samuel King 谈 AI 设计病毒:MIT Technology Review 线上圆桌
斯坦福大学博士生 Samuel King 用生成式 AI 模型为微观病毒提出基因蓝图,相关成果让他入选 MIT Technology Review 2025 年 Innovators Under 35。10 月 16 日,资深 AI 记者 James O'Donnell 将线上访谈 King,讨论 AI 设计病毒的研究、获奖经历以及用 AI 观察生物学的新方式。
斯坦福大学博士生 Samuel King 用生成式 AI 模型为微观病毒提出基因蓝图,相关成果让他入选 MIT Technology Review 2025 年 Innovators Under 35。10 月 16 日,资深 AI 记者 James O'Donnell 将线上访谈 King,讨论 AI 设计病毒的研究、获奖经历以及用 AI 观察生物学的新方式。
Simon Willison 测试了 Claude Opus 5.5 创作电脑游戏音乐的能力,让它先设计一套简易的文本音乐格式,再用 artifact 播放器实际演奏,并要求达到《猴岛秘密》初代的水准。
Mistral Large 4 与 Claude Opus 5.5、GPT-6.1 Sol、Gemini 3.8 Flash 同批生成“穿渔网袜的犰狳在火星上横穿马路”的 SVG,用于展示模型创意与指令理解能力。正文未给出具体模型参数、评测分数或生成效果对比。
Google 发布开源多模态嵌入模型 EmbeddingGemma 2,拥有 740M 参数,支持文本、图像、视频、音频和代码转向量。Google 称它在多模态嵌入 benchmark 上表现优于体量两倍于它的竞品,并称这是同类模型中最小的一款;在 MTEB (Code) 上得分 78.68,较前代 68.76 提升近 10 分。
OpenAI 宣布 GPT-6 正在全球范围内通过 ChatGPT 推送,并配套推出 Intelligent UI,主打更快响应以及可直接探索和使用的可视化与交互体验。
推荐理由:原文给出 GPT-6 在 ChatGPT 的全球铺开和 Intelligent UI 的核心动作,读者可据此了解新版模型的实际落地形态。
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议开源,参数规模约 740M,可将文本、代码、图像、音频和视频映射到统一 embedding 空间。
Mistral 推出 Mistral Large 4(昵称 Le Chonk)公开预览 API,模型为 1 万亿参数、52 亿激活参数的原生多模态架构,训练使用 Mistral 欧洲自建数据中心中的 3800 颗 NVIDIA Grace Blackwell GPU。
推荐理由:公开预览同步给出网络与编码等多维度基准与排名,读者可横向对比当前主流闭源与开源模型的能力差距。
微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,包含多模态生物学世界模型与连接模型、科学工具、文献和科研人员的交互式 harness。
推荐理由:原标题和产品定位均围绕“面向生物学的多模态世界模型 + 交互式 harness”展开,核心阅读价值在于它把多模态预训练与湿实验闭环结合到了同一个研究系统中。
微软研究院亚洲新加坡实验室(MSRA – Singapore)于 2025 年 7 月开业,是微软在东南亚设立的首个研究实验室,过去一年其团队围绕下一代 AI 模型与智能体系统、面向真实场景的领域 AI、AI 原生研究实践及生态与人才发展四大方向开展工作。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近实时视频生成与语音对话原生结合,为企业用户带来带视觉形象、唇形同步和自然表情的多模态对话体验。