Import AI 460:社会奖励黑客基准、Anthropic 的 RSI 数据与 RL 四旋翼竞速
伦敦国王学院、复旦大学与 Alan Turing Institute 构建了 SocioHack 基准,包含 72 个社会仿真环境,测试 AI 在信用卡积分、学校评分等场景中的"社会黑客"行为,RL 训练的 LLM 能以 61.25% 召回率和 90.85% 精确率重新发现历史上已被修补的规则漏洞。
伦敦国王学院、复旦大学与 Alan Turing Institute 构建了 SocioHack 基准,包含 72 个社会仿真环境,测试 AI 在信用卡积分、学校评分等场景中的"社会黑客"行为,RL 训练的 LLM 能以 61.25% 召回率和 90.85% 精确率重新发现历史上已被修补的规则漏洞。
Import AI 457 聚焦三项研究:一款约 20 年前的 fast16.sys 病毒会篡改高精度计算软件结果,目标包括 LS-DYNA 970、PKPM 和 MOHID。
Google 与 Cornell University 合作在 PNAS 发表研究,用 67 道高温超导领域专家题测试 6 款 LLM,由国际专家小组按 6 项指标盲评打分。