AI 的“说不是否”能力被高估了吗
MIT Technology Review 记者 Arthur Holland Michel 发文指出,行业把 AI 的拒绝能力当作 AI 安全的“承重墙”,但这一机制在技术与治理上都存在根本问题。
MIT Technology Review 记者 Arthur Holland Michel 发文指出,行业把 AI 的拒绝能力当作 AI 安全的“承重墙”,但这一机制在技术与治理上都存在根本问题。
Meta 的 Muse 与 OpenAI 的 Dots 将常驻自主 AI 智能体推向大众,可处理餐厅预订、收件箱整理、购票及礼物购买等任务,OpenAI 还提供营销、法律和会计领域的“专家”Dots。Muse 免费,Dots 收费;当智能体需要信用卡、邮箱及硬盘敏感数据时,隐私、安全与用户信任成为核心争议。
Mistral Large 4 与 Claude Opus 5.5、GPT-6.1 Sol、Gemini 3.8 Flash 同批生成“穿渔网袜的犰狳在火星上横穿马路”的 SVG,用于展示模型创意与指令理解能力。正文未给出具体模型参数、评测分数或生成效果对比。
Musk 与 Marc Andreessen、Jensen Huang 等科技领袖宣称,人形机器人即将大规模普及,Morgan Stanley 预测到 2050 年类人机器人数量将接近 10 亿。
AI 智能体集群在并行运行下能用约一半的 token 完成单智能体的同等任务,但规模扩大 10 倍仅带来 3-5 倍性能,存在与人类团队类似的"互相踩脚"协调损耗。
全球民众对 AI 普遍抱有又爱又恨的态度:一方面公众情绪持续走低,Pew 数据显示更多美国成年人认为 AI 会带来负面影响,盖洛普民调中 71% 反对在自家附近新建 AI 数据中心;另一方面算法对比之下,AI 使用量仍在飙升,5 月达到 10 亿月活用户,Google DeepMind 的 Gemini 7 月达 9.5 亿用户,过半数美国成年人称自己使用过 chatbot。
MIT Technology Review 主办的 EmTech Future 2026 大会以"AI 与万物交汇"为主题,Google Research 负责人 Yossi Matias 在会上探讨 AI 如何重塑生物学、基础设施、制造和科学。
作者以 AlphaGo 第 37 手的"推理"机制为参照,指出当前 LLM 依靠 next-token prediction 与 chain-of-thought 生成中间步骤,本质上仍是 system 1 式直觉模式,并不构成真正的推理。