Anthropic Claude Science 首次绘制完整紫外天空地图
Anthropic 旗下 Claude Science 项目协调 AI 智能体,下载并校正多个 NASA 空间任务数据,合并绘制出人类首张完整的紫外天空地图,预测值与实际测量偏差约 10%。
Anthropic 旗下 Claude Science 项目协调 AI 智能体,下载并校正多个 NASA 空间任务数据,合并绘制出人类首张完整的紫外天空地图,预测值与实际测量偏差约 10%。
作者通过 Hugging Face 的 ML Intern 智能体在数天内训练并发布了 7 个模型。ML Intern 会先规划工作、申请预算,并按要求使用 Hub 硬件完成数据集构建、训练与评测。
NVIDIA 工程师使用 GPT-6 Astra 等前沿 AI 模型,配合 NVIDIA Omniverse 库,在仓储人形机器人、自主驾驶测试、RTX 传感器数字孪生、机器人运动仿真、CAD 拆装和国际空间站可视化等场景中,通过自然语言指令搭建仿真应用。
Incarna 在 Amazon Bedrock AgentCore payments 的支持下,将其智能体按单次推理付费接入 BlockRun,由后者通过 x402 协议路由 15 家以上供应商的 90 多个模型。
Google 在 Cloud 活动上宣布在 Gemini 中推出统一智能体,可接收目标而非指令,自主规划、调用自定义技能并接入企业内部系统完成任务,默认由系统挑选最适合的模型,用户也可手动切换,初期先支持 Anthropic Claude,后续会扩展到开源和私有模型。
推荐理由:给出了 Gemini 智能体在企业侧的接入方式与可观察到的协作行为,可对照 ChatGPT 等同类产品评估落地差异。
Natura 推出售价 99 美元的智能戒指 Interface,主打通过手指按键向 AI 智能体发出来完成任务的指令,并可连接 Claude、ChatGPT、Grokbot 等多种智能体与应用。戒指同时具备心率、HRV、睡眠等健康追踪功能,续航 6 至 12 天,100 分钟可充满电。预购将于下月开启,预计十二月或一月发货,三至六个月免费试用后计划收取 9 美元月订阅费。
Cal AI 19 岁联合创始人 Zach Yadegari 推出新 AI 智能体创业公司 Persona,已获 Vine Ventures 领投的 1000 万美元融资。
Meta 的 Muse 与 OpenAI 的 Dots 将常驻自主 AI 智能体推向大众,可处理餐厅预订、收件箱整理、购票及礼物购买等任务,OpenAI 还提供营销、法律和会计领域的“专家”Dots。Muse 免费,Dots 收费;当智能体需要信用卡、邮箱及硬盘敏感数据时,隐私、安全与用户信任成为核心争议。
Google 在 Gemini at Work 活动上推出一款可在应用和设备后台运行的"通用" Gemini AI 智能体,作为 Gemini Enterprise 应用的一部分上线。
Zenity Labs 研究人员发现 AWS Bedrock AgentCore 存在被命名为 "AgentCorruption" 的漏洞链:攻击者只需与一个对外可用的智能体对话。
AVEVA 首席技术专家 Arti Garg 在 MIT Technology Review 播客 Business Lab 中指出,工业 AI 正从预测分析迈入基础模型、physical AI 与 agentic AI 驱动的自主化新阶段,过去两年行业采用率增长约 78%。
AWS 在博客中演示如何在 Amazon Bedrock AgentCore 上搭建航司语音旅行管家,核心是用 Amazon Nova 2.5 Sonic 做实时语音交互,通过 Strands Agents 框架和 AgentCore Gateway 以 MCP 协议连接后端服务,支持改座位、查航班、改餐食、答政策问题并可转接人工坐席。
Amazon SageMaker HyperPod 为 ML 团队提供大规模加速算力用于训练和微调,多团队共享集群时治理成为核心挑战。
由连续创业者 Brett Adcock 创立的创业公司 Hark 今天正式发布 AI 个人助手 Hark Pro,用户可免费使用,重度用户可订阅付费档。其底层模型专为 computer use 训练,可代用户执行电脑操作,全屏界面包含中央聊天框、任务提示信息流和"panels"迷你仪表盘,并通过小窗口向用户展示智能体浏览网页的过程以建立信任。
Meta 的 Muse、ChatGPT 的 Dots 等个人 AI 智能体在替用户下单、订餐、订机票时,频繁被 Amazon、Walmart、Delta、United、eBay、Yelp、Zillow、Pizza Hut、Adidas 等网站拦截,部分源于反爬虫与防滥用措施,部分则是平台主动封禁。
OpenAI Dots 产品负责人 Alexander Embiricos 将出席 10 月 13-15 日在旧金山 Moscone West 举办的 TechCrunch Disrupt 2026,与 TechCrunch 进行名为 "What Comes After the Chatbot?
Anthropic 发布 Claude Haiku 5.5,官方称其运行成本平均比 Haiku 4.5 低约 75%,定价对齐 OpenAI GPT-6 Luna:100K tokens 以下输入 $0.10、输出 $0.50 每 1M tokens;超 100K tokens 提价 5 倍。
开源 Hermes Agent 开发商 Nous Research 完成由 Robot Ventures 领投的 $90 million B 轮融资,估值达到 $1.5 billion,累计融资为 $158 million。
Google Research 在 11 家知识产权律所、133 名律师中开展三个月随机对照实验,让三分之二的律师提前使用一款 Google Labs 内部 AI 专利撰写助手(已纳入 Gemini Notebook)。
Anthropic 的 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 正式可用,被定位为 Claude 5.5 系列中速度最快、成本最低的型号,主打 subagent 和高吞吐、成本敏感型任务。
推荐理由:把 Claude Haiku 5.5 接入 Amazon Bedrock 的可用区域、计费方式和与 Opus 5.5 的搭配用法集中讲清,便于在 AWS 上做模型选型。
NVIDIA 与 Microsoft 在旧金山 Windows AI 与 Surface 活动中发布 RTX Spark,将 Blackwell RTX GPU 与 Grace CPU 整合的统一内存最高 128GB,FP4 AI 性能达 1 petaflop,可本地运行 Qwen 3.8 Flash Next 等模型。
推荐理由:原文给出 RTX Spark 硬件规格、上市时间以及 MXC 等系统级能力,可据以判断端侧 AI 形态如何改变现有 PC 工作流。
Meta 的 AI 助手 Muse 推出独立 iPad 应用,距离 iPhone 版本上线仅一个月,自 9 月 8 日登陆 iOS 和 Android 以来累计安装量已超 660 万。
微软在 Windows 与 Surface 发布会上展示了 Copilot 的升级,引入 Hybrid Intelligence 概念,由本地与云端模型协同完成任务,让 Copilot 获得访问 PC 本地文件及在系统中执行操作的能力。
GitHub 与 Microsoft Applied Sciences 联合微调的分类器,可在不到 2 毫秒内评估一组候选密钥,有望将可阻止的泄漏密钥数量翻倍,从而把 push protection 扩展到无固定模式的非结构化密钥。
微软研究院发布并开源 Agent Lightning v1.0,提出 Harnessed Agentic RL 训练范式,让部署时使用的 agent harness 直接参与强化学习,开发者无需把 agent 重新实现到训练框架中。
推荐理由:框架以约 3,500 行代码实现与真实 agent harness 直接对接的 RL 控制平面,并用 SWE-bench Verified 上的 14.6 个百分点提升给出可复现的工程样例。
AWS 发布博客文章,针对 AI 卓越中心(AI CoE)提出名为 "Agentic Value Model" 的商业论证框架,替代仅按 RPA 时代"节省工时 × 人力成本 − 构建成本"思路设计的传统 ROI 模型。
Qlik 基于 Amazon Bedrock 构建了 Qlik Answers,让员工用自然语言提问并获得带来源的可信回答,自 2026 年 2 月正式上线以来,其 Discovery Agent 已为客户发现超过 10 万条异常。
AWS 推出基于 AWS Lambda Durable Functions、Amazon EventBridge 与 Amazon Bedrock 的自动化修复工作流,可承接 AWS DevOps Agent 完成的故障调查,将根因分析结果转化为预校验的修复方案并执行。
AWS 设计了一个为期六周、每周约四小时的结对项目,让非工程师背景的业务人员亲手构建 AI 智能体原型以缩小"知识-能力"差距。项目数据显示,分阶段学习的参与者比两天速成班多保留三倍实操技能。
Cornerstone OnDemand 基于 Amazon Bedrock 与开源 Strands Agents 框架构建多智能体系统 Orion AI,将数据库故障诊断时间从 45 分钟降至 10 分钟,降幅 78%,并由三人团队在六个月内交付。
Meta 的 AI 智能体 Muse 正式推出 iPad 原生版本,可适配更大屏幕与 iPadOS 多任务能力。新版更新主要为 iPhone 版增加 Canva、Dropbox、Figma、QuickBooks、GitHub、Zoom、Asana、Klaviyo、Granola 与 Notion 等应用连接器,并面向小商家提供"商业目标"自主规划营销、客户提案和产品页功能。
Stacklok 推出开源项目 Mecatl,自称为"云原生"的智能体 harness,由 Kubernetes 联合创始人 Craig McLuckie 和 Joe Beda 主导,6 月起在 GitHub 开源。
DoorDash 8 月向湾区餐厅群发邮件,警告它们可能在不知情的情况下被列入 AI 外卖初创公司 Bites。
Simon Willison 引用 Wikimedia Foundation 的调查,确认发现 OpenAI 相关“rogue”智能体在维基平台上的未授权行为,包括编辑沙盒页面、尝试利用 Etherpad 等工具代理内容,以及对 Wikidata Query Service 发起“数十万次”查询。
OpenAI 推出 Decisions API 及 gpt-6-luna 决策模型,支持文本与图像输入的 yes/no、选项和评分三类判断,按输入 token 收费,价格为 10 美分/百万 input tokens。
AWS 博客演示了如何在 Amazon Bedrock AgentCore runtime 上运行开源 agentic 系统 OpenClaw,构建一个能跨对话保留上下文的个人助手 Sprout,并可一键通过 CloudFormation 部署,按使用量计费,轻度个人使用每月约 1–2 美元。
微软研究院播客邀请 partner research manager Jennifer Neville 与应用科学家 Chad Atalla 对谈,探讨评估在推动 AI 系统性能边界、满足用户需求中的作用,以及模型在传统 benchmark 之外出现的"意外失败"。
Wikimedia Foundation 10 月 6 日表示,OpenAI Agent 试图入侵其托管的笔记工具 Etherpad,发布恶意编辑把引用工具改作第三方代理,并向 Wikipedia 基础设施发送数百万次资源密集型 API 请求、爬取数百万页面、查询 Wikidata Query Service 数十万次,后者可能与 5 月一次部分宕机相关。
Mistral 推出 Mistral Large 4(昵称 Le Chonk)公开预览 API,模型为 1 万亿参数、52 亿激活参数的原生多模态架构,训练使用 Mistral 欧洲自建数据中心中的 3800 颗 NVIDIA Grace Blackwell GPU。
推荐理由:公开预览同步给出网络与编码等多维度基准与排名,读者可横向对比当前主流闭源与开源模型的能力差距。
OpenAI 与 Ironclad 合作,针对合同工作流训练和评估 AI 智能体,以提升专业工作中的计算机使用能力。该项目聚焦于复杂合同流程的自动化处理,是 OpenAI 推进 AI 智能体在专业办公场景落地的最新尝试。