当前位置:

首页 > 业界资讯 > AI大模型时代的发展需要先进的存储技术来实现稳定的进展

AI大模型时代的发展需要先进的存储技术来实现稳定的进展

人工智能学科起源于1956年,之后在接下来的半个世纪中几乎没有取得进展,算力和数据的发展远远落后于算法。然而,随着2000年进入互联网时代,算力的限制被打破,人工智能逐渐渗透到各行各业,并迎来了大规模模型时代的开启。然而,高质量的数据似乎成为了人工智能发展的最后的“瓶颈”华为OceanStorPacific在最近举行的全国高性能计算学术年会(CCFHPCChina2需要重写的是:023)上荣获了“AI存力底座最佳创新奖”AI存力的理念的出现实际上从侧面体现了数据对于AI价值的不断提升需要重写的内容是:01

人工智能学科起源于1956年,之后在接下来的半个世纪中几乎没有取得进展,算力和数据的发展远远落后于算法。然而,随着2000年进入互联网时代,算力的限制被打破,人工智能逐渐渗透到各行各业,并迎来了大规模模型时代的开启。然而,高质量的数据似乎成为了人工智能发展的最后的“瓶颈”

华为OceanStor Pacific在最近举行的全国高性能计算学术年会(CCF HPC China 2需要重写的是:023)上荣获了“AI 存力底座最佳创新奖”

AI大模型时代的发展需要先进的存储技术来实现稳定的进展

AI存力的理念的出现实际上从侧面体现了数据对于AI价值的不断提升

需要重写的内容是:01

数据决定人工智能的智能水平

人工智能的发展是一个不断收集和分析数据的过程。数据作为信息的载体,是人工智能学习和理解世界的基础。通用智能是人工智能发展的最终目标,它能够自主地学习、理解、推理和解决问题,而数据是推动其发展的最大动力

那么,数据越多,AI就越智能吗?只要有大量的数据,AI就能够超越专家的作用吗?

以医学领域的人工智能系统为例,许多诊断案例实际上没有唯一正确的答案。在医学诊断中,每组症状都有一系列不同概率的可能病因,因此人工智能的辅助决策可以帮助临床医生缩小可能的病因范围,直到找到解决方案。在这种情况下,医学人工智能依赖的不是大量数据,而是准确且高质量的数据,只有这样才能确保在“筛查”时不会错过真正可能的病因

数据质量对于AI智能的重要性在这个典型示范中得到了体现

在人工智能行业中,一直存在着一个共识,即“垃圾进,垃圾出”。这意味着,如果没有高质量的数据输入,无论算法有多先进,计算能力有多强大,都无法产生高质量的结果

AI大模型时代的发展需要先进的存储技术来实现稳定的进展

在当今时代,我们正处于大模型的风口之上。人工智能的大模型如雨后春笋般不断涌现。华为的盘古、讯飞的星火、紫东的太初等中国的一批大模型正在快速发展,致力于构建跨行业通用的人工智能能力平台,为各行各业的数字化转型提供动力

根据中国科技部新一代人工智能发展研究中心于五月底发布的《中国人工智能大模型地图研究报告》,已有79个拥有十亿参数规模以上的大模型在中国发布。虽然“百模大战”的格局已经形成,但这也引发了对大模型发展的深入思考

基于小规模数据建立的模型,其表达能力受限于数据规模,只能进行粗粒度的模拟与预测,在精度要求比较高的情况就不再适用。如果想要进一步提升模型精度就需要利用海量数据生成相关模型

重写后的内容是:这意味着数据的数量决定了AI智能的程度。无论数据的质量如何,数据的数量都是建设“AI存力”所需重点关注的领域

需要重写的是:02

在大数据时代,数据所面临的挑战

随着人工智能向大型模型和多模态发展,企业在开发或实施大型模型应用时面临着许多挑战

AI大模型时代的发展需要先进的存储技术来实现稳定的进展

首先,数据预处理的周期很长。由于数据分布在不同的数据中心、不同的应用和不同的系统中,存在归集速度慢等问题,导致预处理百TB数据需要大约10天的时间,系统的利用率从一开始就需要提高效率

其次,训练集加载效率低的问题需要解决。现在大型模型的规模越来越庞大,参数级别达到千亿甚至万亿,训练过程需要大量的计算资源和存储空间。例如,多模态大型模型以海量文本和图片作为训练集,但是当前海量小文件的加载速度较慢,导致训练集加载效率不高

此外,还面临着大型模型参数频繁调优、训练平台不稳定的挑战,平均每两天就会出现一次训练中断。为了恢复训练,需要使用检查点机制,而故障恢复的时间则超过一天,给业务连续性带来了很多挑战

为了在AI大模型时代取得成功,我们需要同时关注数据的质量和数量,并构建大容量、高性能的存储基础设施。这已经成为了取得胜利的关键要素

需要重新写作的内容是:03

AI时代的关键在于存力底座

随着大数据、人工智能等技术与高性能计算的结合,高性能数据分析(HPDA)成为实现数据价值的新形式。通过利用更多历史数据、多元异构算力和分析方法,HPDA能够提高分析精度。这标志着科学研究迈向智能化的新阶段,人工智能技术将加速前沿成果的应用

如今,科研领域正在出现一种基于"数据密集型科学"的新范式。这种范式更加注重将大数据知识挖掘和人工智能训练推理技术相结合,通过计算和分析来获取新的知识和发现。这也意味着对于底层数据基础设施的需求将会发生根本性的改变。无论是高性能计算还是人工智能的未来发展,都需要建立先进的存储基础设施来应对数据的挑战

AI大模型时代的发展需要先进的存储技术来实现稳定的进展

解决数据挑战需要从数据存储创新入手,这正如谚语所说的解铃还须系铃人

AI存力底座是基于OceanStor Pacific分布式存储开发的,并秉承AI Native设计理念,以满足AI各个环节的存储需求。AI系统对存储提出了全面的挑战,包括数据计算加速、数据存储管理以及数据存储和计算之间的高效流通等等。通过采用“大容量存储 + 高性能存储”的组合,可以确保存储资源的调度和协调一致,使每个环节都能高效运转,从而充分释放AI系统的价值

OceanStor Pacific分布式存储如何展现其核心能力呢?

首先,技术架构在业界是独创的。这套存储系统支持无限横向扩展,并且能够处理混合负载,既能高效处理小文件的IOPS,也能高速读写大文件的带宽。它具备智能的性能层和容量层数据分级流转功能,能够实现对海量数据的归集、预处理、训练和推理等全流程的AI数据管理。此外,它还具备与HPC和大数据相同的数据分析能力

重写后的内容为:其次,业内效率最佳的提升方法是通过存储的创新。首先是数据编织,即通过GFS全局文件系统将分散在不同地区的原始数据接入,实现跨系统、跨地区、跨多云的全局统一数据视图和调度,简化数据收集过程。其次是近存计算,通过存储内嵌的算力实现对近数据的预处理,减少无效数据传输,同时降低预处理服务器的等待时间,从而显著提高预处理效率

实际上,"百模大战"并不是AI大模型发展的"标志"。未来,各行各业都将通过AI大模型的能力来推动数字化转型的深入发展,同时数据基础设施的建设也将加速推进。OceanStor Pacific分布式存储在技术架构的创新和高效率的表现,已经证明自己是行业的首选

我们明白,数据已经成为与土地、劳动力、资本、技术并列的新型生产要素。过去数字化市场中的许多传统定义和运行模式都将被重新书写。只有先存力,才能确保数据驱动的人工智能大模型时代稳步向前

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
业界资讯
相关文章 更多
AI大模型专项上市指引落地,科创创业人工智能ETF涨超4%
AI大模型专项上市指引落地,科创创业人工智能ETF涨超4%

AI大模型专项上市指引落地,科创板第五套标准扩展至AI领域,支持优质企业上市。龙头股涨超13%,科创创业人工智能ETF涨超4%。政策驱动明确,美银预计全球AI资本支出达1.7万亿美元,国信证券指出AI商业模式逐步闭环。

捷报频传!成都再添5款生成式AI大模型完成国家备案,备案总量升至23款
捷报频传!成都再添5款生成式AI大模型完成国家备案,备案总量升至23款

成都市新增5款生成式AI大模型通过国家备案,总量升至23款,较2025年增长53%。新模型覆盖工业智造、财经教育、政务文书、媒体等垂直场景,包括蜀天云数、数联慧眼、博特文书、经论大模型和灵知泛传播大模型,为本土AI产业注入新活力。

清华大学揭秘AI大模型的
清华大学揭秘AI大模型的"偷懒"规律

清华大学与OpenBMB联合团队研究发现,混合注意力架构中全注意力层是长文本理解的核心,高效注意力层贡献有限。大窗口滑动注意力会拖延全注意力层发展长距离检索能力,小窗口或去除全注意力层位置编码能显著提升性能。

连续9周领跑!中国AI大模型调用量稳居全球第一
连续9周领跑!中国AI大模型调用量稳居全球第一

中国AI大模型单周调用量20.39万亿Token,环比增8.4%,连续九周全球第一。前三均为中国模型:DeepSeek-V4-Flash六连冠,小米MiMo-V2.5与MiniMaxM3紧随,OwlAlpha、GLM5.2等新模型增长迅猛。

上海智慧调解数据创新实验室揭牌,AI大模型“上岗”解纷靠谱吗?
上海智慧调解数据创新实验室揭牌,AI大模型“上岗”解纷靠谱吗?

上海市智慧调解数据创新实验室揭牌,聚焦矛盾纠纷全链条智能化,引入AI大模型辅助调解。试点显示,案件响应时间压缩至1-2小时,调解员有效工时占比超80%。公共数据同盟与数链空间为数据融合创新提供支撑。

快手发布2026反诈治理报告 AI大模型助推诈骗治理纵深升级
快手发布2026反诈治理报告 AI大模型助推诈骗治理纵深升级

快手发布2026反诈治理报告,AI大模型日均调用84万余次,涉诈账号识别能力提升5倍以上,主动拦截98.1%反诈行为。多类典型诈骗举报量同比大幅下降,全年发送反诈提示2.14亿人次,协助侦破案件2000余起,构建全链路防护体系。

快手发布2026反诈治理报告:AI大模型助推诈骗治理纵深升级
快手发布2026反诈治理报告:AI大模型助推诈骗治理纵深升级

快手发布2026反诈治理报告,依托AI大模型等技术系统性升级反诈体系。报告显示,98.1%的反诈行为在萌芽阶段被拦截,涉诈账号识别与治理能力提升5倍以上,多类典型诈骗举报量同比下降。

芯片紧缺!安波福用上AI大模型预警 推行国产芯片双轨备份
芯片紧缺!安波福用上AI大模型预警 推行国产芯片双轨备份

安波福为应对全球芯片涨价与供应紧张,推行“本土化+全球化”双轨供应链,建立数字孪生系统对进口与国产芯片备份管理,并利用AI大模型实时预警、提前储备存储芯片,同时优化电源管理系统以减少对高成本功率芯片的依赖。

中科院:AI大模型
中科院:AI大模型"更努力学习"反而更容易忘光,真相让人意外

研究对比了自蒸馏策略优化(SDPO)与组相对策略优化(GRPO)两种AI训练方法,发现SDPO虽在单任务上表现更优,但连续多领域训练后灾难性遗忘更严重,甚至导致崩溃;GRPO进步缓慢却能稳固保留旧能力。密集监督并非持续学习的最佳策略,精准稳健的训练方向更为关键。

字节跳动与复旦大学联手,让AI大模型
字节跳动与复旦大学联手,让AI大模型"变形"更聪明

FlashMorph是一种混合注意力模型选层方法,通过联合优化门控值实现全注意力与线性注意力层的自动选择。仅需2000万个词元,选层效率较传统方法提升2500倍,在长文本检索任务中性能优异,推理速度提升2倍以上,显著降低计算开销与内存占用。

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。