圆溜溜阿圆

BitCPM-CANN

互联网 2026-05-25 20:39:54

BitCPM-CANN是面壁智能联合清华大学与OpenBMB开源社区联合推出的,中国首个完全基于华为昇腾国产算力平台完成端到端训练的1.58-bit三值大模型。模型采用量化感知训练路线,包含0.5B至8B四个尺寸,推理阶段释放约6倍显存红利,模型能力保留率达90.1%–97.2%,标志着国产NPU首次拥有完整的低比特训练栈。