跳到正文
  1. TechCrunch · AI82

    Google 在 Gemini 上推出企业版智能体,支持 Anthropic Claude 等模型可选

    Google 在 Cloud 活动上宣布在 Gemini 中推出统一智能体,可接收目标而非指令,自主规划、调用自定义技能并接入企业内部系统完成任务,默认由系统挑选最适合的模型,用户也可手动切换,初期先支持 Anthropic Claude,后续会扩展到开源和私有模型。

    推荐理由:给出了 Gemini 智能体在企业侧的接入方式与可观察到的协作行为,可对照 ChatGPT 等同类产品评估落地差异。

  1. Google DeepMind88

    Google DeepMind 发布 Gemini 4 Argon,主打 1M token 长链推理与网络安全防御

    Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,面向软件工程、法律与金融知识工作以及网络安全防御等长链路复杂流程。模型输出 token 上限从 64K 提升到 1M,定价为输入 $2 / 输出 $10 每百万 token,缓存输入享 95% 折扣。

    推荐理由:官方一次性放出 1M 输出 token、$2/$10 per M tokens 定价与 Fairwind 安全分阶段策略,方便和同代前沿模型直接做能力与部署节奏比较。

  1. Google DeepMind68

    Google DeepMind 发布 SynthID Bio,为 AI 生成蛋白质引入水印

    Google DeepMind 推出 SynthID Bio,用于给 AI 设计的蛋白质序列与 AlphaFold 3 预测的三维结构嵌入可验证水印。

    推荐理由:SynthID Bio 把水印从数字内容带到蛋白质序列与三维结构层面,给 AI 生成生物设计提供可验证溯源信号。

  1. Google Research60

    Google Research 提出 AI 视频联合导演框架,把多智能体协同用于长视频一致性生成

    Google Research 发布一套面向长视频生成的多智能体框架 AI video co-director,将长视频创作建模为全局优化与世界状态追踪问题,包含 Co-Director、CANVAS、A²RD 和 VQQA 四个组件,分别负责层级化编排、视觉分镜、长时间序列外推与插值、以及基于视觉问答的闭环提示词优化。

    推荐理由:原文以统一框架把多镜头分镜、长时间序列生成与闭环修复拆成四块,给出了可直接对照的多镜头一致性基准结果。

  1. Google DeepMind68

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 发布两款文本转语音模型 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,分别面向深度创意角色设计与高吞吐低成本场景。

    推荐理由:两款 TTS 模型在多角色台词导演、长音频一致性和音色克隆安全机制上做了系统级说明,读者可对照自身配音与多语种本地化场景评估。

  1. Google DeepMind67

    Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音对话模型

    Google DeepMind 推出两款实时语音对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,面向语音 Agent 与对话场景,强调并行推理与低延迟。

    推荐理由:同一篇官方文章同时给出实时语音模型的评测名次、上线渠道与多语言能力,便于读者对照自身场景选择发布能力。

  1. Google DeepMind62

    Google DeepMind 发布 AlphaGenome Atlas,覆盖 90 亿个人类基因组单字母变异预测

    Google DeepMind 推出 AlphaGenome Atlas,预计算了人类基因组中 90 亿种单核苷酸变异(single-nucleotide variant)的分子效应,数据量约 1 PB,体积是 AlphaFold Database 的 30 倍以上。

    推荐理由:对 90 亿个单核苷酸变体做分子效应预测,可在编码与非编码区统一打分,可一次性把相关论文级方法转成可访问资源。

已经到底了