跳到正文
今天10月9日周五1 条
10月8日周四
  1. NVIDIA Blog82

    NVIDIA 与 Microsoft 发布 RTX Spark 与 Windows AI 智能体平台

    NVIDIA 与 Microsoft 在旧金山 Windows AI 与 Surface 活动中发布 RTX Spark,将 Blackwell RTX GPU 与 Grace CPU 整合的统一内存最高 128GB,FP4 AI 性能达 1 petaflop,可本地运行 Qwen 3.8 Flash Next 等模型。

    推荐理由:原文给出 RTX Spark 硬件规格、上市时间以及 MXC 等系统级能力,可据以判断端侧 AI 形态如何改变现有 PC 工作流。

10月7日周三
10月2日周五
10月1日周四
9月24日周四
  1. GitHub Blog · AI & ML21

    GitHub Copilot 应用如何高性能渲染巨型 Pull Request

    GitHub Copilot 应用针对巨型 Pull Request 重构了 diff 视图渲染架构,将文档高度拆分为代码几何与动态块几何两个独立域:代码行高度在绘制前即可精确计算,评论、回复框等动态块则按需懒测量并以文件、行号和侧别为锚点定位,避免估算误差和滚动跳变。文章以一个含 2200 个文件、超 100 万行变更和 400 余条行内评论的开源 PR 为极端用例验证性能。

  2. Microsoft Research50

    微软研究院提出物理 AI 推理卸载方法并扩展 Physical AI Toolchain

    微软研究院发布物理 AI 推理研究:系统评估把机器人 GPU 推理卸载到边缘或云端的效果。在移动操作任务上,卸载显著提升了任务成功率、响应速度与续航,例如相较小型 GPU,映射与规划任务在 A100 上快 383%,物体交接任务成功率提升达 50%,Jetson Thor 等大型板载 GPU 可额外消耗机器人最多 160% 电量。

  3. Google DeepMind50

    Google Private AI Compute 引入服务端持久化记忆,密钥仅存用户设备

    Google 在 Private AI Compute 架构中新增持久化记忆层,将用户数据密封在专用加密存储中,解密密钥仅保存在用户设备上,连 Google 自身也无法访问;当模型需要调用数据时,设备会通过端到端加密信道连接到云端 secure enclave,在隔离内存中临时解密处理并立即重新加密。

9月19日周六
9月10日周四
  1. Mistral AI27

    Mistral 与 Cloudera 合作,将专用、可自主控制的 AI 部署到企业数据环境中

    Mistral 与 Cloudera 宣布合作,将 Mistral 模型集成进 Cloudera 的混合数据平台,让客户可在私有云、公有云、本地及完全气隔离环境中运行推理,并在受控环境下基于自有专有数据训练定制模型,数据与产出模型的所有权归客户所有。该合作面向金融、制造、电信等受监管行业,目标是满足对 sovereign AI(数据、推理、算力与运营均由客户掌控)的增长需求。

7月29日周三