今日必看

AI 早报

今天最重要的 AI 变化。频道按你关心的领域,雷达按来源发现。

总收录
491
当前类目
36
当前批次
2026/09/03

今日必看

#21

Google AI 团队分享如何为 LLM-as-a-Judge 评测编写可靠的评分标准

Google AI 团队发布教程,讲解如何为 LLM-as-a-Judge 评测编写可靠的布尔式评分标准,指出模糊提示会导致评估不一致和浪费 token。文中给出四条经验:问题保持原子化且互不重叠、只让评判模型评估客观事实(可用 RFC 2119 术语如 MUST 表述)、只评 prompt 中明确要求的内容、用专家标注的 golden set 校准评判模型

推荐理由7 日窗口收录,分类页滚动库存。
模型与工程AIHOT feed.xml
#26

美国司法部介入纽约时报诉 OpenAI 案,主张 AI 训练属合理使用

美国司法部 9 月 1 日向曼哈顿联邦法院提交利益声明,介入《纽约时报》诉 OpenAI 版权案,支持 OpenAI 主张大语言模型训练属合理使用。DOJ 以国家安全和 AI 产业竞争力为主要论据,称训练使用具有转换性;《纽约时报》发言人批评政府站在 AI 公司一边牺牲创作者权益。法官要求双方最迟 9 月 4 日提交简易判决动议,该案结果可能为 AI 训练版

推荐理由7 日窗口收录,分类页滚动库存。
模型与工程AIHOT feed.xml