Meta 的 AI 智能体 Muse 登陆 iPad,新增 Canva、GitHub 等多款应用连接器
Meta 的 AI 智能体 Muse 正式推出 iPad 原生版本,可适配更大屏幕与 iPadOS 多任务能力。新版更新主要为 iPhone 版增加 Canva、Dropbox、Figma、QuickBooks、GitHub、Zoom、Asana、Klaviyo、Granola 与 Notion 等应用连接器,并面向小商家提供"商业目标"自主规划营销、客户提案和产品页功能。
Meta 的 AI 智能体 Muse 正式推出 iPad 原生版本,可适配更大屏幕与 iPadOS 多任务能力。新版更新主要为 iPhone 版增加 Canva、Dropbox、Figma、QuickBooks、GitHub、Zoom、Asana、Klaviyo、Granola 与 Notion 等应用连接器,并面向小商家提供"商业目标"自主规划营销、客户提案和产品页功能。
OpenAI 发布 Decisions API,可对文本、图像或两者进行评估,速度约为 Responses API 的十倍,当前处于公开 beta 阶段,仅支持 gpt-6-luna 模型,输入价格为每百万 token 0.10 美元、输出免费。
Google 推出基于浏览器的 AI 平台 Playground,美国成年人只需输入文本即可创建游戏,无需编程技能;该平台由 Gemini、Nano Banana 和 Lyria 模型驱动,支持调整规则、物理角色和场景,生成的游戏可发布至公共画廊,部分类型支持排行榜及多人模式。同批 Google 与 Unity 发布面向专业开发者的 AI 工具 Unity Spark,闭测将于 2026 年启动。
Google 推出升级版 SynthID AI 内容检测器,并上线独立网站 SynthID.com 向全球用户开放使用。该检测器现在可识别所有合作伙伴生成的 SynthID 水印,不再仅限 Google 自家版本。
OpenAI 将在 ChatGPT for Teens 中推出 College Planner,帮助学生管理大学申请流程,并同步上线闪卡、测验等学习功能,以及由青少年组成的 AI 委员会以参与产品方向讨论。
Radisson Hotel Group 联合 Accenture,基于 OpenAI 技术为 ChatGPT 开发了一款插件,让旅客可以在规划行程时直接通过 ChatGPT 查找、对比并预订酒店。
Latent Space 的 AINews 汇总 10/5–10/6 多日动态:OpenAI 公开发布来自未公开内部模型的 722 篇数学手稿,覆盖 372 个结果族。
Simon Willison 发布 llm-mistral 0.16 版本,与 llm 638 mistral 68、llm-reasoning 105 等标签相关,属于 Mistral 系列模型的 llm CLI 插件月度更新。该项目支持 $10/月订阅,作者会以摘要形式向订阅者推送当月重要的 LLM 动态。
Reflection 发布 Beam,这是一款面向编码、智能体与科研场景的纯文本 MoE 模型,总参数量 501B、激活 23B,在 23.8T token 上从零预训练,全权重将在本月以 Apache 2.0 开源。
NVIDIA 宣布 DGX Spark 将于 10 月 23 日通过 Acer、ASUS、Dell、Gigabyte、HP 与 MSI 推出 64GB 统一内存版本,起售价 4999 美元,保留 GB10 Grace Blackwell Superchip、DGX OS 与完整 NVIDIA AI 软件栈,可本地运行最高 100B 参数模型。
Earendil 旗下 AI 编程代理 Pi 发布 1.0 版本及 Pi Durable,1.0 新增 Codemode(原生支持 MCP、Jev 与图像模型)、扩展支持虚拟模型、延迟工具加载、anthropic 模型缓存预热、会话中段系统消息、新 TUI 主题和默认全屏模式。
OpenAI 推出 GPT-6 Astra Ultrafast,运行于 NVIDIA Blackwell GPU,现已在 OpenAI API 及符合条件的 ChatGPT Work 和 Codex 用户中开放。
Google DeepMind 推出 SynthID Bio,用于给 AI 设计的蛋白质序列与 AlphaFold 3 预测的三维结构嵌入可验证水印。
推荐理由:SynthID Bio 把水印从数字内容带到蛋白质序列与三维结构层面,给 AI 生成生物设计提供可验证溯源信号。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近实时视频生成与语音对话原生结合,为企业用户带来带视觉形象、唇形同步和自然表情的多模态对话体验。
Google 在 Private AI Compute 架构中新增持久化记忆层,将用户数据密封在专用加密存储中,解密密钥仅保存在用户设备上,连 Google 自身也无法访问;当模型需要调用数据时,设备会通过端到端加密信道连接到云端 secure enclave,在隔离内存中临时解密处理并立即重新加密。
Google DeepMind 发布两款文本转语音模型 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,分别面向深度创意角色设计与高吞吐低成本场景。
推荐理由:两款 TTS 模型在多角色台词导演、长音频一致性和音色克隆安全机制上做了系统级说明,读者可对照自身配音与多语种本地化场景评估。
Google Research 发布一项新研究实验,让教师通过生成式 UI(GenUI)动态创建定制化的交互式学习模拟,覆盖物理、化学、生物、数学等 STEM 学科,面向中学阶段。
Google DeepMind 推出 AlphaGenome Atlas,预计算了人类基因组中 90 亿种单核苷酸变异(single-nucleotide variant)的分子效应,数据量约 1 PB,体积是 AlphaFold Database 的 30 倍以上。
推荐理由:对 90 亿个单核苷酸变体做分子效应预测,可在编码与非编码区统一打分,可一次性把相关论文级方法转成可访问资源。
Mistral 推出 Agentic Search,作为 Mistral Search Toolkit 与 Libraries(Studio、Vibe 内置)的检索组件,模型可对 search、open、navigate、read、grep 五种工具进行多轮调用,从而在长文档与跨源场景中查找、打开并核验信息。