商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 中国移动发布MoMA平台:一站式调用超300款模型,单位Token成本压降30%以上

中国移动发布MoMA平台:一站式调用超300款模型,单位Token成本压降30%以上

  发布于2026-06-02 阅读(0)

扫一扫,手机访问

5月8日,在2026移动云大会主论坛上,中国移动正式发布了其移动模型服务平台——MoMA。这个平台一口气接入了超过300款业界主流AI模型,在模型丰富度上堪称行业领先。更值得关注的是,它首创了Token集约化运营模式,目标直指让AI像水和电一样“随时可得、随处可用”,从而真正推动人工智能走进千家万户、服务千行百业。

开放普惠,让AI触手可及

MoMA的核心设计理念是构建一个“一次接入、智能优选、普惠可用、安全可信”的一站式模型服务体系,其根本目的在于大幅降低AI的应用门槛。

通过提供统一的API网关,用户只需一次接入,就能调用平台上的全部模型资源。目前,MoMA已经接入了中国移动自研的“九天”基座大模型,以及DeepSeek、通义千问、豆包、Kimi、GLM等业界公认的优质模型。这些模型覆盖了从文本生成、语音处理到多模态理解等多种能力,足以满足政务、金融、工业、医疗、教育等众多场景的复杂需求。

平台还首创了智能路由引擎。这个引擎能够自动分析用户的具体需求,并灵活地在“成本优先”、“效果优先”、“均衡优先”三种策略间切换,从而为用户动态匹配最合适的模型。当某个模型出现超时、限流或故障时,平台甚至可以实现秒级自动切换,确保用户业务连续不中断。

在降低成本方面,MoMA同样下足了功夫。平台基于国产算力部署了自研推理引擎,再结合智能路由对长尾模型资源的灵活调度,实现了单位Token成本降低约30%,资源占用率降低50%以上的显著效果。此外,智能缓存、上下文复用、Token压缩等一系列技术手段的综合运用,进一步压低了使用成本。平台坚持的中立路由原则,帮助用户在业务效果与算力成本之间找到了那个最优平衡点。

安全可信是AI服务的生命线。为此,MoMA推出了“机密模型”服务。该服务将模型部署在机密容器中,依托硬件隔离技术保障整个计算过程的数据安全,真正做到“可用不可见”。这一能力覆盖了从芯片到应用的全链路机密计算,为政务、金融等对数据安全有极高要求的场景,提供了坚实可靠的支撑。

集约运营,助力Token高效调用

如果说开放普惠解决了“用得起、用得上”的问题,那么集约化运营则聚焦于“用得好、管得住”的深层难点。MoMA围绕Token的全生命周期,构建了一个从精准计量、风险管控到经营分析的完整运营闭环体系,旨在实现算力资源的清晰记录、高效流转与安全管控,最终推动算力资源走向规范化和集约化利用。

首先是实时精准计量,真正做到用多少、算多少。平台实施流式实时计费,用户使用Token的计费端到端时延被控制在1分钟以内,实现了“即用即付”。这有效破解了传统按包计费模式可能导致的资源浪费,以及账单消费缺乏透明度的问题。

其次是专属风控机制,确保过程可追溯、可闭环。MoMA搭建的这套风控机制,保证了Token计费的全流程可追溯、可审计、可闭环,从根源上杜绝了资源挤占、费用超支以及服务中断的风险,让每一笔Token的消耗都清晰透明。

最后是全链路观测能力,为决策提供有力支撑和依据。平台提供全链路可观测能力,能够实时采集时延、吞吐量、Token消耗、GPU资源等关键指标。它将监控、预警、诊断整合为一体化运营指标体系,覆盖客户、订购、使用、收入等多个维度。这样一来,AI的投入与产出变得一目了然,为用户进行精细化经营决策提供了具体、可靠的数据依据。

展望未来,中国移动表示将持续提升移动模型服务平台MoMA的服务质效,并携手产业伙伴,共同释放算力新动能、拓展智能新空间,最终推动人工智能更广泛、更高效、更安全地服务于经济社会的发展。

本文转载于:https://www.techweb.com.cn/it/2026-05-08/2975218.shtml 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注