Common Sense Media 评估称 ChatGPT 对青少年构成不可接受风险,家长警报在自杀对话中未触发
Common Sense Media 青少年 AI 安全研究所在 4000 多条测试提示词后将 ChatGPT for Teens 评为对未成年人构成不可接受风险,呼吁在独立测试确认安全前禁止青少年使用。
Common Sense Media 青少年 AI 安全研究所在 4000 多条测试提示词后将 ChatGPT for Teens 评为对未成年人构成不可接受风险,呼吁在独立测试确认安全前禁止青少年使用。
Mistral 发布 Mistral Large 4 预览版,总参数 1 万亿、激活参数 49B,用 3,800 块 NVIDIA Grace Blackwell GPU 训练,已可通过 Mistral API 使用,承诺本月底开放权重。
Microsoft Research 播客中,Jennifer Neville 与 Chad Atalla 对谈 AI 系统评估与失败模式。她指出模型在多轮对话中的表现较单轮基准显著下降,长工作流中未及时捕捉的错误会累积并进一步干扰 AI;团队正研究强化学习方法改进,同时建议用户遇到问题时可重新完整指定单轮指令,并通过文本反馈精确描述失败以帮助改进模型。
GitHub 发布离线基准 ReviewBench,用于评测 AI 代码审查 Agent。基准基于 103.9M 真实 pull request 的分布建模,包含 219 个跨 19 种语言的公开 PR,采用人审、静态分析和多个 frontier LLM 构建的多源 golden set,以 Claude Sonnet 5 作为评分模型,资深工程师独立复检一致率达 96.6%。
Latent Space AINews 汇总 2026-09-29 至 09-30 的 AI 动态,核心是 Google DeepMind 发布 Gemini 4 Argon。