🐦
Colibri v1.5.0
新增 DeepSeek V4 Flash 支持 + 8 条安全公告
🆕 v1.5.0
🚀 DeepSeek V4
🔒 8 条安全公告
📦 23.5K Stars
🚀 DeepSeek V4
🔒 8 条安全公告
📦 23.5K Stars
📅 发布日期:2026-08-05 | 🔗 发布页:GitHub Releases
🆕 DeepSeek V4 Flash 支持
v1.5.0 最大的亮点是新增了对 DeepSeek V4 Flash (284B) 的原生支持!这是 Colibri 支持的第五个模型家族。
核心特性
📊
284B 总参数
13B 激活
⚡
原生 fp4
专家权重
🧠
fp8-e4m3
密集权重
🔥
无需转换
直接运行
技术细节
- ✅ MLA 注意力 – Multi-head Latent Attention
- ✅ DSA 稀疏注意力 – Dynamic Sparse Attention
- ✅ 43 层架构 – 256 个路由专家 + 1 个共享专家
- ✅ 原生 MXFP4 – QAT 训练的专家权重
快速开始
cd c make deepseek-v4 python ./coli chat --model /path/to/DeepSeek-V4-Flash --ram 22 # 可选参数 ./coli web --model /path/to/DeepSeek-V4-Flash ./coli serve --model /path/to/DeepSeek-V4-Flash
🔒 8 条安全公告
v1.5.0 同时发布了 8 条安全公告,建议所有用户升级。主要涉及:
| 公告 | 严重性 | 说明 |
|---|---|---|
| #8 | 高 | MTP 头必须使用 int8(int4 会导致 0-4% 接受率) |
| #108 | 中 | gs64 容器质量提升,避免 per-row int4 的精度问题 |
| #455 | 中 | 修复 think-mode 循环和永不终止生成问题 |
| #163 | 低 | SPEC_PIN=1 确保草稿和验证使用相同内核 |
⚠️ 重要:请阅读完整的安全公告:GitHub Releases
📦 完整模型支持列表
Colibri 现已支持 5 个模型家族,覆盖从 7B 到 2.8T 参数的范围:
| 模型 | 总参数 | 激活参数 | 磁盘 | 内存 | 状态 |
|---|---|---|---|---|---|
| OLMoE | 7B | 1B | ~4 GB | 8 GB | ✅ |
| GLM-5.2 ⭐ | 744B | 40B | ~372 GB | 16-24 GB | ✅ |
| Inkling | 975B | 41B | ~469 GB | 25-120 GB | ✅ |
| Kimi K3 | 2.8T | 104B | ~1.6 TB | 32+ GB | ✅ |
| DeepSeek V4 🆕 | 284B | 13B | ~167 GB | 16-22 GB | ✅ |
💡 关键发现:所有模型都不需要 GPU!只需一个足够快的硬盘和足够的内存。
🚀 版本历史
v1.5.0
最新
最新
DeepSeek V4 Flash 支持 + 8 条安全公告
2026-08-05
v1.4.0
旧版
旧版
Vulkan 后端支持 + 改进的归档打包
2026-08-01
v1.3.0
旧版
旧版
早期稳定版本
2026-07-29
📚 相关链接
🐦
Tiny engine, immense model.
v1.5.0 让 Colibri 更加强大!
