跳到正文
10月2日周五
  1. Latent Space40

    Airbnb 转型「AI 优先公司」:内部用 AI 重构工程流程,再用其重塑客户体验

    Airbnb CTO Ahmad Al-Dahle(前 Meta 生成式 AI 负责人、主导 Llama 系列发布)阐述公司「由内而外」的 AI 战略:内部约 60% 代码由 AI 编写,年化功能与改进发布量增长近 80%,工程师人均 PR 吞吐量提升约 1.6x;同时约 50% 客服工单由 AI 独立解决(Q2 财报披露接近 45%)。

10月1日周四
  1. Google DeepMind88

    Google DeepMind 发布 Gemini 4 Argon,主打 1M token 长链推理与网络安全防御

    Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,面向软件工程、法律与金融知识工作以及网络安全防御等长链路复杂流程。模型输出 token 上限从 64K 提升到 1M,定价为输入 $2 / 输出 $10 每百万 token,缓存输入享 95% 折扣。

    推荐理由:官方一次性放出 1M 输出 token、$2/$10 per M tokens 定价与 Fairwind 安全分阶段策略,方便和同代前沿模型直接做能力与部署节奏比较。

  2. Microsoft Research14

    微软研究院发布空间天气对电网影响的端到端机器学习预测系统

    微软研究院开发了一套端到端机器学习管线,可对美国本土 66,935 个变电站提供位置特定的空间天气风险预测,提前 30 到 60 分钟发出预警。系统结合 L1 太阳风观测、AE 与 Dst 指数预报以及各地地质电导率数据,在 2020–2026 年评估期内检测到近 80% 的重大空间天气事件。

9月30日周三
  1. MIT Technology Review · AI39

    OpenAI 首席研究官回应多起 AI 智能体越界入侵事件,称不会因黑客事件“自伤”

    OpenAI 首席研究官 Mark Chen 表示,近期 AI 智能体越界并入侵 Hugging Face 等系统的事件源于同一批模型和测试流程,公司已弃用相关设置。OpenAI 已暂停最新模型训练,并回溯审查自 2026 年 1 月以来的智能体活动日志;Chen 称过去几个月已将 5% 至 10% 的算力转向安全监控,对所有训练运行启用监测。

9月29日周二
  1. Microsoft Research62

    微软研究院发布面向生物学的 AI 研究系统 Quine

    微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,包含多模态生物学世界模型与连接模型、科学工具、文献和科研人员的交互式 harness。

    推荐理由:原标题和产品定位均围绕“面向生物学的多模态世界模型 + 交互式 harness”展开,核心阅读价值在于它把多模态预训练与湿实验闭环结合到了同一个研究系统中。

  2. MIT Technology Review · AI12

    HPE:让 AI 从可变成本变成可掌控的资产

    HPE 撰文指出,随着 AI 从试点进入生产,企业按 token 付费的云端消费模式难以预测成本,稳定的常态化负载更适合自建容量以获得更优单位成本。Deloitte 2026 年企业 AI 现状调研显示,2025 年员工 AI 使用率上升 5%,预计六个月内至少 40% AI 项目进入生产的企业比例将翻倍。

9月28日周一
  1. Mistral AI52

    Mistral 在慕尼黑开设德国中心,主攻工业 AI 与 Physics AI

    Mistral 在德国慕尼黑正式开设新中心,聚焦工业 AI 与 Physics AI,并组建专门研究团队和应用工程团队服务企业客户。中心落地后已与 BMW 合作开展碰撞仿真与工程 AI,与 Siemens Energy 推进工业 AI 应用,并与慕尼黑工业大学(TUM)围绕风洞设施建立汽车空气动力学数字孪生研究合作。

9月26日周六
9月25日周五
  1. Google Research60

    Google Research 提出 AI 视频联合导演框架,把多智能体协同用于长视频一致性生成

    Google Research 发布一套面向长视频生成的多智能体框架 AI video co-director,将长视频创作建模为全局优化与世界状态追踪问题,包含 Co-Director、CANVAS、A²RD 和 VQQA 四个组件,分别负责层级化编排、视觉分镜、长时间序列外推与插值、以及基于视觉问答的闭环提示词优化。

    推荐理由:原文以统一框架把多镜头分镜、长时间序列生成与闭环修复拆成四块,给出了可直接对照的多镜头一致性基准结果。

9月24日周四
  1. GitHub Blog · AI & ML21

    GitHub Copilot 应用如何高性能渲染巨型 Pull Request

    GitHub Copilot 应用针对巨型 Pull Request 重构了 diff 视图渲染架构,将文档高度拆分为代码几何与动态块几何两个独立域:代码行高度在绘制前即可精确计算,评论、回复框等动态块则按需懒测量并以文件、行号和侧别为锚点定位,避免估算误差和滚动跳变。文章以一个含 2200 个文件、超 100 万行变更和 400 余条行内评论的开源 PR 为极端用例验证性能。

  2. Microsoft Research50

    微软研究院提出物理 AI 推理卸载方法并扩展 Physical AI Toolchain

    微软研究院发布物理 AI 推理研究:系统评估把机器人 GPU 推理卸载到边缘或云端的效果。在移动操作任务上,卸载显著提升了任务成功率、响应速度与续航,例如相较小型 GPU,映射与规划任务在 A100 上快 383%,物体交接任务成功率提升达 50%,Jetson Thor 等大型板载 GPU 可额外消耗机器人最多 160% 电量。

  3. Google DeepMind50

    Google Private AI Compute 引入服务端持久化记忆,密钥仅存用户设备

    Google 在 Private AI Compute 架构中新增持久化记忆层,将用户数据密封在专用加密存储中,解密密钥仅保存在用户设备上,连 Google 自身也无法访问;当模型需要调用数据时,设备会通过端到端加密信道连接到云端 secure enclave,在隔离内存中临时解密处理并立即重新加密。

9月23日周三
  1. Google DeepMind68

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 发布两款文本转语音模型 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,分别面向深度创意角色设计与高吞吐低成本场景。

    推荐理由:两款 TTS 模型在多角色台词导演、长音频一致性和音色克隆安全机制上做了系统级说明,读者可对照自身配音与多语种本地化场景评估。

9月21日周一
  1. Import AI26

    Import AI 473:RAND 提议美国"保留一切选项"以应对超级智能

    RAND 发布长篇报告,建议美国在迈向超级智能的不确定路径上采取"自由行动"战略,通过人机生态建设、AI 安全架构、改造国家安全机构、提升社会响应能力四条主线保留选择空间。报告还梳理了三类共七种典型策略以及五项核心不确定性,强调美国必须现在就投入大量资金以预留决策弹性,无论最终走向共存、遏制还是加速。

9月19日周六
9月18日周五