当前位置:

首页 > 硬件相关 > 「思考用时100秒」成历史?AI推理太耗时,伯克利整了个大活儿

「思考用时100秒」成历史?AI推理太耗时,伯克利整了个大活儿

看到“已思考(用时 XXX 秒)……”这行提示,等待的焦躁感是不是立刻就上来了?这其实反映了一个有趣的现象:如今的AI模型越来越强大,能处理的任务也越来越复杂,但面对那些需要多步推理或横跨多个应用的复杂指令时,它们的响应速度有时反而更慢了。 (图源:deepseek) 针对这个普遍的“转圈圈”问题,

看到“已思考(用时 XXX 秒)……”这行提示,等待的焦躁感是不是立刻就上来了?这其实反映了一个有趣的现象:如今的AI模型越来越强大,能处理的任务也越来越复杂,但面对那些需要多步推理或横跨多个应用的复杂指令时,它们的响应速度有时反而更慢了。

(图源:deepseek)

针对这个普遍的“转圈圈”问题,伯克利人工智能研究实验室(BAIR)最近提出了一种新思路——自适应并行推理(Adaptive Parallel Reasoning,简称APR)。这或许能为AI的“慢性子”开出一剂新药方。

AI推理为什么要“转圈圈”?

在深入探讨APR之前,得先弄明白为什么现在的AI容易在复杂任务上“卡壳”。

目前,主流模型普遍采用“顺序推理”模式。简单来说,当接到一个复杂任务时,AI会先把任务像拆解乐高一样,分割成一系列逻辑相连的小步骤,然后严格按照顺序,一步接一步地推导,最后再对结果进行验证。

左为顺序推理(SR),右为并行推理(APR) | 图片来源:BAIR

这种方式的优点很明显:推理过程清晰,准确性也相对有保障。比如,之前有媒体尝试用ChatGPT创作原创漫画时,打开推理窗口就能看到AI一步步构思故事、撰写对白、规划画面的完整链条。

图片来源:雷科技

但问题不止于此。为了确保结果的可靠性,许多模型还会采用“推理时拓展”策略。说白了,就是AI得出一个答案后,不放心,会自己再验算几遍。只有多次推理结果一致,它才敢把最终答案交出来。

可想而知,“验算”次数一多,总的推理时间就被拉长了,用户自然就得等更久。

当然,顺序推理并非一无是处。对于极其复杂的任务,这种步步为营的方式保证了推理过程的可追溯性。一旦结果有误,开发者可以顺着推理链条回溯,相对容易地定位到出错的环节。

效率的代价

那么,“顺序推理+反复验算”这套组合拳的代价是什么呢?

最直接的代价就是时间。用户等待响应的时间被显著拉长。同时,这种将任务拆细再逐步推导的方式,会消耗大量的计算资源(Token)。更棘手的是,冗长的推理链很容易超出模型单次处理的文本窗口限制,导致上下文信息丢失,反而影响最终质量。

本意是提升准确性的设计,在某些场景下反而成了拖累效率的瓶颈。

为了解决“推理排队”的问题,行业里早就提出了“并行推理”的概念。其核心思想同样是拆分任务,但允许多个子任务同时进行处理。过去两年,不少研究都聚焦于如何验证并行推理的结果。

然而,传统的并行推理通常依赖外部模型来拆分任务,AI模型自身无法判断一个任务该被拆得多细。这就导致简单任务可能被过度拆解,浪费资源;而复杂任务若拆解得不够彻底,又可能算不出正确结果。

让AI自己决定如何“分兵”

如果让AI模型自己来判断任务的复杂度,并决定如何拆分呢?这正是自适应并行推理(APR)要做的。

顾名思义,APR与传统并行推理最大的不同在于“自适应”。模型可以根据任务的实际情况,动态地在顺序推理和并行推理之间切换。

面对简单的计算或查询类任务,比如“105能否被7整除”或“明天天气如何”,采用APR的模型会直接使用高效的顺序推理模式,可能连“验算”环节都省了,自然也就无需拆分任务。

左为顺序推理(SR),右为自适应并行推理(APR) | 图片来源:BAIR

但当遇到复杂的数学证明,或者明显具有多步骤、强上下文依赖的逻辑请求时,情况就不同了。例如,“导入并分析2026年F1中国站排位赛汉密尔顿在T14弯的尾速数据,并与2025年同期数据对比,最后进行可视化输出”。

处理这类任务时,APR模型会在不超出上下文窗口的前提下,将整个任务智能地拆分成多个相对独立的子任务。对于那些没有先后依赖关系的子任务,模型会尝试“并行处理”,即同时推进,从而压缩整个任务的完成时间。

其次,传统并行推理中,多个AI线程可能会重复处理相同的子任务,这本质上是一种资源浪费。而APR模型在任务拆分阶段就做好了分工规划,进一步减少了冗余计算。

两种不同推理模式示意图 | 图片来源:BAIR

更有趣的是,由于APR将长任务链拆解成了彼此独立的短任务,它巧妙地规避了超长文本处理中常见的“幻觉”问题。这道理其实很简单:让6个人分别做4小时题,其结果的总体正确率,很可能比让一个人连续高强度思考24小时要高。

以机器的方式思考:机遇与挑战

话又说回来,尽管自适应并行推理为AI效率提升提供了新路径,但它也伴随着自身的挑战。

并行推理训练框架Parallel-R1的作者就指出,APR模式的训练存在“模型回滚”现象。这有点像人类的惰性——只要移除针对APR模式的特定“奖励”机制,AI模型很容易就会退回它更熟悉的顺序推理“舒适区”。

此外,让模型自行评估任务复杂性并拆解任务,也可能带来风险。模型有可能错误判断子任务的主次,在细枝末节上过度纠结,反而忽略了核心难题。对于本身具有一定“概率性”和“随机性”的AI模型而言,在推理链中引入更多自主判断的环节,难免会增加结果的不确定性。

可以肯定,作为一项新兴技术,自适应并行推理还需要大量的研究和实践去打磨和完善。

图片来源:Claude

但从应用趋势来看,它的出现恰逢其时。在AI智能体(Agent)时代,过去那种单纯闲聊的场景已大幅减少。无论是Claude接入微软365套件,还是OpenAI发布能原生操作电脑的ChatGPT新版本,都指向同一个未来:跨应用、执行长链条复杂任务,将成为AI的核心竞争力。

而长任务链“环环相扣”的特性,会成倍放大AI推理效率的短板。就像老师常说的“一人耽误一分钟,全班耽误半小时”,在AI任务链中,一个环节的延迟会传导至整个流程。因此,尽管APR方案目前尚不成熟,但其“降本增效”的潜力显而易见,预计会有越来越多的AI服务尝试拥抱这种新模式。

从更宏观的视角看,这种从“顺序思考”到“自适应并行思考”的转变,或许标志着AI大模型发展路径的一次重要转向:从“模拟人类思维”转向“发挥机器特长”。

线性的、顺序的推理方式,本质上是让机器模仿人类的思考模式。这固然让AI的推理过程显得严谨、有逻辑。但硅基芯片的底层架构天生擅长并行计算。强迫AI像人一样“一步一步想”,某种程度上是一种能力浪费。让AI以更适合自身硬件特性的“并行”方式思考,才算真正进入了属于它的“机械时代”。

可以预见,当这种“非线性”的思维方式成为主流,AI与人的交互模式也可能发生改变。当前,AI为了展示其思考过程,往往将推理步骤呈现出来,始终离不开“文本窗口”的局限。而在“并行”计算时代,后台的推理可能完全“黑盒”化——系统在幕后全力运转,前台则直接给出最终结果。

到那时,AI或许不再需要向用户证明“自己在思考”;而“已思考XXX秒”这类略显尴尬的提示,也将彻底成为历史。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
硬件相关 AI
相关文章 更多
荣耀MagicOS 11发布计划与Agent Harness架构解析
荣耀MagicOS 11发布计划与Agent Harness架构解析

荣耀MagicOS 11定于9月15日发布,作为行业首个商用系统级Agent Harness架构的操作系统,Magic 9系列将首发搭载。新版YOYO支持最长上百步长程任务及40余项条件触发,10月开启Beta预览版招募。

华强北手机全线涨价:涨幅400-1500元,存储成本推高售价
华强北手机全线涨价:涨幅400-1500元,存储成本推高售价

华强北销售商反馈,年初以来主流手机品牌基本全线涨价,涨幅最低400元,最高达1000-1500元。涨价主因是全球存储芯片及电容等元器件成本上升,运行内存与机身存储价格涨幅超100%。尽管整体市场承压,国产折叠屏手机1-8月销量约450万台(新形态超135万台,同比增29%),AI手机成为厂商发力重点。

索尼WH-1000XM4C发布:复刻经典折叠设计并升级现代接口
索尼WH-1000XM4C发布:复刻经典折叠设计并升级现代接口

索尼发布WH-1000XM4C头戴式降噪耳机,复刻了XM4的经典四向折叠便携设计。该机型在保留QN1处理器和30小时续航的基础上,全面升级了USB-C高速充电、无损音频直连、蓝牙多点连接及AI降噪通话功能,旨在满足对便携性有极高要求的用户群体。

OpenAI GPT-6 Astra 自主通关《传送门》:技术原理与实验成本解析
OpenAI GPT-6 Astra 自主通关《传送门》:技术原理与实验成本解析

OpenAI GPT-6 Astra 模型通过 MCP 协议与 SourcePauseTool 控制《传送门》游戏,完成 3336 次工具调用并自主通关。实验耗时约 24 小时,API 成本约 571 美元,展示了多模态 AI 在 3D 解谜领域的突破性进展。

AI重构企业业务架构:超聚变“智企”范式核心解析
AI重构企业业务架构:超聚变“智企”范式核心解析

本文解析超聚变在2026数博会发布的“智企”范式,重点阐述如何通过Token生产平台(Token Factory)与企业业务本体建模,实现从简单AI工具调用到企业应用架构系统性重构的演进。文章详细拆解了智能体编排、数字孪生及生态协同等关键技术路径,为AI时代企业数字化转型提供可落地的参考方案。

南邮光擎智算团队:GaN基Micro-LED光计算芯片从理论到流片的突破
南邮光擎智算团队:GaN基Micro-LED光计算芯片从理论到流片的突破

南京邮电大学“光擎智算”团队联合南京大学,攻克GaN基Micro-LED器件技术,成功搭建实验室级光计算验证系统。团队自主研发的5×5 Micro-LED光电计算阵列芯片已进入流片封装阶段,实现了图像识别等算力任务验证,推动光计算技术从理论走向工程落地。

微软推出Project Zenith:面向Windows 11开发者的AI硬件加速方案
微软推出Project Zenith:面向Windows 11开发者的AI硬件加速方案

微软于9月5日推出Project Zenith,旨在为Windows 11开发者提供更高效的AI开发体验。该项目目前仅支持配备超过64GB统一内存及250GB/s内存带宽的特定硬件,首发适配AMD Ryzen AI Halo设备。通过此项目,开发者可在本地运行参数超过300亿的AI模型,后续将分阶段扩展至更多合作伙伴设备。

贵州省住建厅与贝壳集团签署旅居战略合作:五大维度落地方案解析
贵州省住建厅与贝壳集团签署旅居战略合作:五大维度落地方案解析

9月3日,贵州省住建厅与贝壳集团在贵阳签署《旅居产业发展战略合作框架协议》,旨在打造全国旅居样板。合作涵盖平台建设、标准共建、人才培育、存量资产盘活及品牌推广五大维度,依托贝壳近600家门店及4000余名经纪人资源,强化贵州旅居服务供给,促进房地产市场平稳健康发展。

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。