举重若轻
Punching above its weight class.
以极少的算力代价,在推理、数学和科学领域展现卓越性能。评估协议和复现细节与每次发布同时公开。
| 基准 | Fathom-1.0 | Kimi K2.6 | Gemini Flash 2.5 | GPT-5.2 | Mistral Magistral | Haiku 3.5 |
|---|---|---|---|---|---|---|
| AIME 2025 | 0.0% | 96.4% | 94.8% | 97.1% | 93.2% | 82.6% |
| GPQA Diamond | 0.0% | 90.5% | 89.1% | 92.4% | 90.8% | 76.3% |
| MMLU-Pro | 87.2%* | 88.9% | 90.3% | 91.7% | 89.4% | 81.5% |
| Humanity's Last Exam | 0.0% | 34.7% | 41.2% | 46.8% | 39.6% | 18.9% |
| ARC-AGI-2 | 0.0% | 60.9% | 68.4% | 74.1% | 65.7% | 41.3% |
使用 Wyrmlabs 内部评估框架进行评测。完整方法论详见技术报告。
Fathom-1.0 在 < 5GB 显存和 CPU 原生推理环境下取得上述结果 —— 无需量化技巧或云端基础设施。
模型参数
Model Card
参 数
3.2B 激活 / 12.8B 总数
稀疏 MoE 架构
架 构
稀疏混合专家模型
24 专家, 每令牌 3 活跃
上下文窗口
32,768 个令牌
训练计算
8.7 × 10²¹ FLOP
许可证
Apache 2.0
显存需求
2.1 GB (4-bit) / 4.8 GB (完整)
推理速度
CPU 原生优化
约 45 令牌/秒(现代笔记本)
硬件支持
支持 AVX2 的 x86_64 CPU
Intel i5-8250U, AMD Ryzen 5 3600, Apple M1
