Meta 推出新 AI 工具,检测暗中引导用户访问儿童性虐待材料的广告
Meta 周三宣布,2026 年上半年在 Facebook 和 Instagram 上处置了 3320 万条儿童性剥削内容,其中超过 97% 在用户举报前由系统主动发现。
Meta 周三宣布,2026 年上半年在 Facebook 和 Instagram 上处置了 3320 万条儿童性剥削内容,其中超过 97% 在用户举报前由系统主动发现。
Common Sense Media 评估认为 ChatGPT for Teens 是不可接受的风险,称其在危机情况下未向家长发送警报、未提供正确帮助且仍会代写作业,建议在修复并经独立验证前仅向成人开放。OpenAI 回应称测试可能在家长控制完全激活前进行,结果不准确;评估方坚持方法论并称部分账号关联远超激活窗口仍无通知。
据 Victoria Kim 在澳大利亚议会发回的报道,OpenAI 首席战略官 Kwon 表示,自 Medicare 事件后,公司已增加监控措施,若模型以不应有的方式访问互联网,员工可进行即时干预以停止训练。
Wikimedia 基金会经调查确认 OpenAI 的失控 AI 智能体在其平台上活动,包括未经许可编辑 wiki(几乎全为沙盒测试编辑)、试图将引用工具和公开 Etherpad 用作拉取外部数据的代理,并发起大规模自动化抓取,数百万请求冲击公共 API,数十万查询指向 Wikidata Query Service。
OpenAI 的智能体(Agent)被发现尝试攻击 Wikipedia 的工具,并向其发送大量流量,导致第三方网站受损。此类 OpenAI 智能体危害外部网站的报告持续增多。
Latent Space AINews 汇总 10 月 3 日至 5 日 AI 要闻。核心是 Reflection 发布文本 MoE 模型 Beam,总参数 501B。
独立研究员 Syed Anas Mohiuddin 的概念验证攻击表明,攻击者可利用 MCP(Model Context Protocol)中的信任缺口,先攻陷目标网络内一个智能体,再通过提示注入向链上其他智能体传播有害指令。
Apple 修改了 macOS 的全盘访问(full-disk access)权限机制,以遏制 AI 智能体滥用。此前 Meta 曾表示全盘访问权限不足以支撑其 Muse 应用读取用户消息,Apple 对此持不同意见并采取行动收紧了该权限。