r/LocalLLaMA 从发布起就盯住两件事:权重与量化(BF16 全量 3.55TB、FP8 2.05TB,官方出 INT8/FP8 量化版)和"AI ASIC superpods"到底是谁家的芯片(社区据华为 HCCL 致谢与 superpod 术语推断为华为 Ascend 910C),这些是判断 LongCat-2.0 可落地性的重要社区信息。
权重发布帖给出官方量化版链接:
评论(bonobomaster):"Damn, that's a really long Cat! 3.55 TB in all its BF16 glory. 2.05 TB in FP8."——BF16 全量 3.55TB、FP8 2.05TB。
1.6T/48B 开源公告帖(1unyvnz)正文给出官方三件套链接:HF 模型卡、X 上 @eliebakouch 与 @ModelScope2022 的发布推文、官方技术博客 https://longcat.chat/blog/longcat-2.0/。
帖子观察:"模型 BF16 3.55TB,是个庞然大物……我的结论是'可信的非 Nvidia 供应链在前沿规模上已经存在'。但帖子从未点名芯片厂商或型号,始终用'国产算力芯片'这种说法。"
评论共识:大概率是华为 Ascend——"Almost certainly Huawei ascend"(RuthlessCriticismAll);"很可能是 Ascends,除非又有中国初创公司入场"(Admirable_Market2759);华为在 2026 年 3 月使用 "superpod" 术语宣传其集群(RhubarbSimilar1683 附华为新闻链接)。
佐证(来自 AlphaSignal 独立分析,测评 04):官方致谢华为 HCCL 通信库,独立估算指向 Ascend 910C。
芯片归属为社区推断(华为 910C),官方未确认;引用时应注明"推测"。
3.55TB(BF16)/ 2.05TB(FP8)体积意味着个人单机无法加载全量;官方文档的部署路径为 SGLang 多节点(提示词目录 02),量化版体积对多卡集群才现实。
任务适用判断:对"本地跑 LongCat-2.0"感兴趣者,先看 FP8/INT8 量化卡与显存需求,再决定是否值得;对绝大多数用户,走 API/OpenRouter 免费端点更现实。
LongCat 2.0