发布于2026-08-21 阅读(0)
扫一扫,手机访问
快科技6月30日消息,今天美团正式发布了新一代万亿参数大模型LongCat-2.0,并且宣布将对外开源。先划几个重点:这是业界第一个完全依靠国产算力完成训练和推理全流程的万亿参数模型,总参数量达到1.6万亿,从零开始预训练,原生支持1M超长上下文。
在此之前,LongCat的测试版本已经在OpenRouter上跑出了不错的成绩——总调用量挤进全球前三。具体到两个细分榜单:Hermes月调用量全球第一,Claude Code月调用量全球第二,仅次于Claude Opus 4.8。能在这些熟悉的基准上追到这种位置,说明底子确实够硬。
LongCat团队还放出消息,近期会把Infra框架、推理引擎、模型参数等核心技术一并开源,算是给全球开发者社区的一份回馈。

预训练数据方面,规模超过30T tokens,覆盖中文、英文、多语言和代码等多类数据。真正硬核的地方在于,面对万卡级训练中常见的硬件故障、通信异常、显存压力与数值波动,LongCat团队从稳定性、正确性和效率三个维度逐一攻克,把国产算力训练这件事基本做透了。
稳定性上,通过HCCL异常处理、弹性扩缩卡和自动故障恢复,月均日故障率直接拉低70%以上。正确性方面,自研了确定性算子、Bitwise一致性验证和参数检测,确保训练结果可靠的同时,还基于实战经验提升了关键模块的计算精度、优化了Reduce逻辑。效率更是关键——通过流水线调度、显存优化和算子级控核,训练MFU提升了1.5倍。
最终,LongCat实现了稳态日吞吐超过1T tokens/day,在国产算力上完成万亿参数MoE模型的稳定训练。这个里程碑,意味着国产大模型在基础设施层面又往前迈了一大步。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9