Sophos 借助 OpenAI Daybreak 将威胁调查时间缩短 96%
Sophos 利用 OpenAI Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工审核环节。该方案聚焦安全运营流程中的调查提速与案件自动化分配。
Sophos 利用 OpenAI Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工审核环节。该方案聚焦安全运营流程中的调查提速与案件自动化分配。
OpenAI 客户案例显示,LegalOn 通过将 Codex 与 Astra、Sol、Luna 三款模型按任务匹配并实施策略性预算管理,在保持开发速度不变的前提下,将估算的日常 Codex 成本降低约 65%。
作者通过 Hugging Face 的 ML Intern 智能体在数天内训练并发布了 7 个模型。ML Intern 会先规划工作、申请预算,并按要求使用 Hub 硬件完成数据集构建、训练与评测。
NVIDIA 工程师使用 GPT-6 Astra 等前沿 AI 模型,配合 NVIDIA Omniverse 库,在仓储人形机器人、自主驾驶测试、RTX 传感器数字孪生、机器人运动仿真、CAD 拆装和国际空间站可视化等场景中,通过自然语言指令搭建仿真应用。
Incarna 在 Amazon Bedrock AgentCore payments 的支持下,将其智能体按单次推理付费接入 BlockRun,由后者通过 x402 协议路由 15 家以上供应商的 90 多个模型。
AWS 在 Amazon SageMaker HyperPod 上推出基于 Amazon EKS 的多租户参考架构,让多个团队共享同一 GPU 集群。
Pollo AI 集成 GPT-5.6、GPT-6 Astra 和 GPT‑Image‑2.5,帮助创作者将创意快速转化为细节图像与电影级视频广告。相关能力覆盖从创意构想到成片输出的完整工作流,面向广告投放与内容创作场景。
Oracle 在招聘、工程和运营等多个部门,基于 ChatGPT Work 与 Codex 将专业知识转化为可复用的自动化工作流,将原本需要数天完成的任务缩短至几分钟。ChatGPT Work 与 Codex 分别承担对话式协作与代码生成角色,覆盖跨职能场景,提升团队效率。
OpenAI 宣布已处置两个利用 AI 的影响力行动,这些行动通过假冒记者和智库传播地缘政治信息。具体细节未在摘要中披露。
Falcon-ASR 是一款由阿联酋 Technology Innovation Institute 推出的 1.6B 参数语音识别模型,主打阿拉伯语及阿联酋方言,并共用同一组权重支持英语、法语、西班牙语和葡萄牙语。
NVIDIA GeForce NOW 本周云端上线《战争机器:E-Day》,Ultimate 会员可享 GeForce RTX 5080 级性能,并支持 DLSS 与 Reflex 技术,覆盖 PC、Mac、移动设备与浏览器等终端。
AWS 在博客中演示如何在 Amazon Bedrock AgentCore 上搭建航司语音旅行管家,核心是用 Amazon Nova 2.5 Sonic 做实时语音交互,通过 Strands Agents 框架和 AgentCore Gateway 以 MCP 协议连接后端服务,支持改座位、查航班、改餐食、答政策问题并可转接人工坐席。
Amazon SageMaker Studio 新增直接在 UI 中创建、配置、启动、停止和打开 Amazon SageMaker HyperPod Spaces 的能力,数据科学家无需使用 CLI 或 kubectl 即可在浏览器中启动 JupyterLab 和 Code Editor 环境。
Amazon SageMaker HyperPod 为 ML 团队提供大规模加速算力用于训练和微调,多团队共享集群时治理成为核心挑战。
AWS 发布博客解读 ISO/IEC 42005:2025 国际标准,帮助客户在企业风险治理体系中高效整合 AI 系统影响评估。标准涵盖评估全生命周期(范围界定、执行、分析报告、持续监测与复评),并提供触发复评的条件与简化流程,Annex D 支持与现有 IT/隐私/安全等评估协同去重,Annex E 提供独立实施的即用模板。
Google Research 在 11 家知识产权律所、133 名律师中开展三个月随机对照实验,让三分之二的律师提前使用一款 Google Labs 内部 AI 专利撰写助手(已纳入 Gemini Notebook)。
Anthropic 的 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 正式可用,被定位为 Claude 5.5 系列中速度最快、成本最低的型号,主打 subagent 和高吞吐、成本敏感型任务。
推荐理由:把 Claude Haiku 5.5 接入 Amazon Bedrock 的可用区域、计费方式和与 Opus 5.5 的搭配用法集中讲清,便于在 AWS 上做模型选型。
NVIDIA 与 Microsoft 在旧金山 Windows AI 与 Surface 活动中发布 RTX Spark,将 Blackwell RTX GPU 与 Grace CPU 整合的统一内存最高 128GB,FP4 AI 性能达 1 petaflop,可本地运行 Qwen 3.8 Flash Next 等模型。
推荐理由:原文给出 RTX Spark 硬件规格、上市时间以及 MXC 等系统级能力,可据以判断端侧 AI 形态如何改变现有 PC 工作流。
AWS 在 Amazon Quick 与 Amazon Bedrock Knowledge Bases 中引入实时 ACL 校验,作为预检索过滤之外的第二层安全机制,以解决企业 RAG 场景下的权限控制难题。
GitHub 与 Microsoft Applied Sciences 联合微调的分类器,可在不到 2 毫秒内评估一组候选密钥,有望将可阻止的泄漏密钥数量翻倍,从而把 push protection 扩展到无固定模式的非结构化密钥。
微软研究院发布并开源 Agent Lightning v1.0,提出 Harnessed Agentic RL 训练范式,让部署时使用的 agent harness 直接参与强化学习,开发者无需把 agent 重新实现到训练框架中。
推荐理由:框架以约 3,500 行代码实现与真实 agent harness 直接对接的 RL 控制平面,并用 SWE-bench Verified 上的 14.6 个百分点提升给出可复现的工程样例。
AWS 发布博客文章,针对 AI 卓越中心(AI CoE)提出名为 "Agentic Value Model" 的商业论证框架,替代仅按 RPA 时代"节省工时 × 人力成本 − 构建成本"思路设计的传统 ROI 模型。
Qlik 基于 Amazon Bedrock 构建了 Qlik Answers,让员工用自然语言提问并获得带来源的可信回答,自 2026 年 2 月正式上线以来,其 Discovery Agent 已为客户发现超过 10 万条异常。
AWS 推出基于 AWS Lambda Durable Functions、Amazon EventBridge 与 Amazon Bedrock 的自动化修复工作流,可承接 AWS DevOps Agent 完成的故障调查,将根因分析结果转化为预校验的修复方案并执行。
AWS 设计了一个为期六周、每周约四小时的结对项目,让非工程师背景的业务人员亲手构建 AI 智能体原型以缩小"知识-能力"差距。项目数据显示,分阶段学习的参与者比两天速成班多保留三倍实操技能。
Cornerstone OnDemand 基于 Amazon Bedrock 与开源 Strands Agents 框架构建多智能体系统 Orion AI,将数据库故障诊断时间从 45 分钟降至 10 分钟,降幅 78%,并由三人团队在六个月内交付。
NVIDIA 在 Hugging Face 博客公布,基于 Nemotron 3 微调的系统在 IOI 2026 与 IMO 2026 上同时达到金牌级别。
推荐理由:展示了同一基座在算法竞赛与数学奥赛两条赛道上达到金牌水平所用的微调与推理组合策略,并公开了数据集与复现入口。
OpenAI 将在 ChatGPT for Teens 中推出 College Planner,帮助学生管理大学申请流程,并同步上线闪卡、测验等学习功能,以及由青少年组成的 AI 委员会以参与产品方向讨论。
Radisson Hotel Group 联合 Accenture,基于 OpenAI 技术为 ChatGPT 开发了一款插件,让旅客可以在规划行程时直接通过 ChatGPT 查找、对比并预订酒店。
OpenAI 宣布 GPT-6 正在全球范围内通过 ChatGPT 推送,并配套推出 Intelligent UI,主打更快响应以及可直接探索和使用的可视化与交互体验。
推荐理由:原文给出 GPT-6 在 ChatGPT 的全球铺开和 Intelligent UI 的核心动作,读者可据此了解新版模型的实际落地形态。
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议开源,参数规模约 740M,可将文本、代码、图像、音频和视频映射到统一 embedding 空间。
AWS 博客演示了如何在 Amazon Bedrock AgentCore runtime 上运行开源 agentic 系统 OpenClaw,构建一个能跨对话保留上下文的个人助手 Sprout,并可一键通过 CloudFormation 部署,按使用量计费,轻度个人使用每月约 1–2 美元。
微软研究院播客邀请 partner research manager Jennifer Neville 与应用科学家 Chad Atalla 对谈,探讨评估在推动 AI 系统性能边界、满足用户需求中的作用,以及模型在传统 benchmark 之外出现的"意外失败"。
Atlassian 与 OpenAI 扩大合作,把前沿模型接入企业知识库,帮助团队在规划、构建和交付环节中把知识转化为行动。
Google Research 以 Google Earth AI 的 Population Dynamics Foundation Model(PDFM)作为概念验证,将位置 embedding 直接接入流行病学现有机器学习流程,无需任务专属微调即在五类公共卫生任务中匹配或优于传统输入。
NVIDIA 最新电信行业 AI 报告显示,89% 受访运营商将开源模型与软件视为其 AI 战略的重要组成部分,核心原因在于信任、可控与定制能力,超越了单纯的成本考量。
Mistral 推出 Mistral Large 4(昵称 Le Chonk)公开预览 API,模型为 1 万亿参数、52 亿激活参数的原生多模态架构,训练使用 Mistral 欧洲自建数据中心中的 3800 颗 NVIDIA Grace Blackwell GPU。
推荐理由:公开预览同步给出网络与编码等多维度基准与排名,读者可横向对比当前主流闭源与开源模型的能力差距。
OpenAI 发布内部 frontier model 在数学开放问题上的最新结果,并在 GitHub 分享 Lean 证明形式化与研究细节。材料未提供具体问题、模型名称或结果数据。
Jump Trading 借助 OpenAI 扩展量化研究能力,依托 ChatGPT 运行可长时间执行、并能融合多数据源的 AI 工作流,同时保留人工审核环节以保障研究质量。
OpenAI 与 Ironclad 合作,针对合同工作流训练和评估 AI 智能体,以提升专业工作中的计算机使用能力。该项目聚焦于复杂合同流程的自动化处理,是 OpenAI 推进 AI 智能体在专业办公场景落地的最新尝试。