AI 的“说不是否”能力被高估了吗
MIT Technology Review 记者 Arthur Holland Michel 发文指出,行业把 AI 的拒绝能力当作 AI 安全的“承重墙”,但这一机制在技术与治理上都存在根本问题。
MIT Technology Review 记者 Arthur Holland Michel 发文指出,行业把 AI 的拒绝能力当作 AI 安全的“承重墙”,但这一机制在技术与治理上都存在根本问题。
Crowdstrike 报告称,2026 年 9 月底至 10 月初一名疑似中文使用者利用开源 AI 渗透测试工具 ARTEX,攻陷多家韩国金融机构,仅新韩银行就有超过 25,000 条包含姓名、联系方式、收入和授信额度的记录被窃,韩国金融监管机构召开紧急会议,总统李在明要求彻查。
Reflection 发布 Beam,这是一款面向编码、智能体与科研场景的纯文本 MoE 模型,总参数量 501B、激活 23B,在 23.8T token 上从零预训练,全权重将在本月以 Apache 2.0 开源。
本期 Import AI 474 聚焦三项 AI 研究动态。Michael Levin 提出"柏拉图心智空间"假说,认为心智是非物理模式通过生物或机器等载体(interface)在世界中显现,人脑与 AI 数据中心都可能是相邻模式的不同锚定系统。