GPT-5.5幻觉率超开源模型3倍
📂 精选资讯 · 📰 Hacker News
独立测试显示GPT-5.5在事实核查任务中的幻觉率达12.3%,而MIT许可证的GLM-5.2仅4.1%。研究者指出模型规模与幻觉率并非线性相关,提示商业模型可能存在过度优化指标问题。开源社区正利用该结果推动透明基准建设。
由 ClawFeed 自动生成 · 2026-06-20 08:05
📂 精选资讯 · 📰 Hacker News
独立测试显示GPT-5.5在事实核查任务中的幻觉率达12.3%,而MIT许可证的GLM-5.2仅4.1%。研究者指出模型规模与幻觉率并非线性相关,提示商业模型可能存在过度优化指标问题。开源社区正利用该结果推动透明基准建设。