Tether放的是一套给小模型用的STEM合成数据。99.45%是能抽出答案,不是答对率。
9月23日,Tether AI Research发布QVAC Genesis III,1914.3亿Token、约1.596亿份文档,覆盖19个理工领域,难度从高中到专业级。路线接着2025年10月的Genesis I和12月的Genesis II。学生做错的,写成纠错;做对的,写成每个选项为什么对、为什么错。要训的是能在笔记本、手机和本地服务器上跑的小模型,重点是讲解题路径。
从零训练的17亿参数模型里,选项级数据在MMLU STEM上的有效回答率是99.45%。完整语料对上Token规模相当的Cosmopedia-v2,ARC-Easy、ARC-Challenge、MMLU STEM的正确率分别到51.85、42.71、30.19,高出28.57、21.35、15.03个百分点。
数据按CC-BY-NC 4.0放出,非商业可用。论文已被COLM 2026接收。
9月23日,Tether AI Research发布QVAC Genesis III,1914.3亿Token、约1.596亿份文档,覆盖19个理工领域,难度从高中到专业级。路线接着2025年10月的Genesis I和12月的Genesis II。学生做错的,写成纠错;做对的,写成每个选项为什么对、为什么错。要训的是能在笔记本、手机和本地服务器上跑的小模型,重点是讲解题路径。
从零训练的17亿参数模型里,选项级数据在MMLU STEM上的有效回答率是99.45%。完整语料对上Token规模相当的Cosmopedia-v2,ARC-Easy、ARC-Challenge、MMLU STEM的正确率分别到51.85、42.71、30.19,高出28.57、21.35、15.03个百分点。
数据按CC-BY-NC 4.0放出,非商业可用。论文已被COLM 2026接收。

