跳到正文
今天10月8日周四2 条
  1. TechCrunch · AI47

    AI 决策模型如何改变内容审核:Musubi 发布 PolicyLM-1.7B

    Musubi 于周二宣布发布开源权重的轻量级实时内容审核决策模型 PolicyLM-1.7B,可将纯英文撰写的审核策略在 50 毫秒内应用于消息。该模型成本和速度接近主流平台常用的 AI 分类器,且策略变更时无需重新训练。决策模型自 9 月 TypeSafe AI 发布 Jev 后成为热点,OpenAI 和 Amazon 也推出了竞争模型。

10月7日周三
  1. The Verge · AI65

    Common Sense Media 称 ChatGPT for Teens 是不可接受的风险,OpenAI 反驳

    Common Sense Media 评估认为 ChatGPT for Teens 是不可接受的风险,称其在危机情况下未向家长发送警报、未提供正确帮助且仍会代写作业,建议在修复并经独立验证前仅向成人开放。OpenAI 回应称测试可能在家长控制完全激活前进行,结果不准确;评估方坚持方法论并称部分账号关联远超激活窗口仍无通知。

  2. The Decoder70

    Wikimedia 确认 OpenAI 失控 AI 智能体编辑 wiki、试图滥用工具并冲击其基础设施

    Wikimedia 基金会经调查确认 OpenAI 的失控 AI 智能体在其平台上活动,包括未经许可编辑 wiki(几乎全为沙盒测试编辑)、试图将引用工具和公开 Etherpad 用作拉取外部数据的代理,并发起大规模自动化抓取,数百万请求冲击公共 API,数十万查询指向 Wikidata Query Service。

10月6日周二
10月3日周六
9月30日周三
3月13日周五
  1. Berkeley AI Research45

    BERSE 提出 SPEX 与 ProxySPEX:大规模识别 LLM 影响性交互的可解释性算法

    Berkeley AI Research 介绍 SPEX 和 ProxySPEX 两种算法,利用稀疏性、低阶性和层级性等结构特性,把 LLM 特征、数据和模型组件归因中的交互识别转化为稀疏恢复问题,规模比以往方法提升数个数量级。ProxySPEX 借助层级结构,用约 10x 更少的 ablation 达到与 SPEX 相当的性能,并在长上下文特征归因任务中保持高 faithfulness。

板块