当前位置:

首页 > 软件教程 > 腾讯大模型开源,Int4对标DeepSeek,谷歌2GB多模态惊艳登场

腾讯大模型开源,Int4对标DeepSeek,谷歌2GB多模态惊艳登场

图片大家好,我是专注AI学习的老章最近除了阿里Qwen3模型上线了图像生成与处理新功能,大家纷纷尝试吉卜力风格创作外,还有几款新发布的开源大模型值得关注:一是腾讯推出了80B规模的混元A13B模型,最大亮点是实现了近乎无损精度的int4量化,性能强劲二是谷歌发布了轻量级多模态模型Gemma3n,主打可在手机端运行,最低仅需2GB内存三是我发现了一个小众但实用的超长上下文模型Jan-nano-128k,仅2.5GB的Q4_K_M版本就支持128K上下文长度腾讯混

全新大模型开源,腾讯(int4能打DeepSeek) Vs 谷歌(2GB运行多模态)图片大家好,我是专注 AI 学习的老章

最近除了阿里 Qwen3 模型上线了图像生成与处理新功能,大家纷纷尝试吉卜力风格创作外,

还有几款新发布的开源大模型值得关注:

一是腾讯推出了 80B 规模的混元 A13B 模型,最大亮点是实现了近乎无损精度的 int4 量化,性能强劲
二是谷歌发布了轻量级多模态模型 Gemma 3n,主打可在手机端运行,最低仅需 2GB 内存
三是我发现了一个小众但实用的超长上下文模型 Jan-nano-128k,仅 2.5GB 的 Q4_K_M 版本就支持 128K 上下文长度

腾讯混元 A13B

官方技术报告已经写得非常详尽,有兴趣的朋友可以深入阅读[1]

试用地址:https://hunyuan.tencent.com/?model=hunyuan-a13b

全新大模型开源,腾讯(int4能打DeepSeek) Vs 谷歌(2GB运行多模态)图片核心优势一览

小模型,大能力:仅激活 130 亿参数(总参数达 800 亿),在多项基准测试中表现媲美更大规模模型
双模式推理:支持“快思考”与“慢思考”两种模式。默认为慢思考输出,若需快速响应,可在输入前加 /no_think
超长文本理解:原生支持 256K 上下文窗口,在处理长文档任务时性能稳定
强化 Agent 能力:在 BFCL-v3、τ-Bench、C3-Bench 等智能体评测中表现领先
高效推理机制:采用分组查询注意力(GQA),支持多种量化格式,显著提升推理效率

我参考的是魔搭社区上的中文解读版技术博客[2],总结出几个关键点:

  1. 腾讯同步开源了两个重要数据集:ArtifactsBench 用于弥补代码评估中的视觉与交互差距[3],而 C3-Bench 是专为智能体设计的评测集,帮助揭示模型短板并推动可解释性研究[4]

  2. A13B 在数学、科学推理及 Agent 场景下,可与 OpenAI-o1-1217、DeepSeek R1、Qwen3-A22B 正面较量

Agent

全新大模型开源,腾讯(int4能打DeepSeek) Vs 谷歌(2GB运行多模态)图片3. Hunyuan-A13B-Instruct-GPTQ-Int4 量化版本几乎与原版无差,堪称精度无损!

Bench Hunyuan-A13B-Instruct Hunyuan-A13B-Instruct-GPTQ-Int4
OlympiadBench 82.7 84.0
AIME 2024 87.3 86.7
Gsm8k 94.39 94.24
BBH 89.1 87.91
DROP 91.1 91.05

这意味着本地部署时,完全可以使用 int4 版本

完整模型约 160GB,int4 版本仅约 44GB,估计 4 张 4090 显卡即可流畅运行

全新大模型开源,腾讯(int4能打DeepSeek) Vs 谷歌(2GB运行多模态)https://modelscope.cn/models/Tencent-Hunyuan/Hunyuan-A13B-Instruct-GPTQ-Int4/https://modelscope.cn/models/Tencent-Hunyuan/Hunyuan-A13B-Instruct-GPTQ-Int4/

int4 版本部署命令如下:

# 下载模型:# ModelScope: modelscope download --model Tencent-Hunyuan/Hunyuan-A13B-Instruct-GPTQ-Int4# 拉取国内镜像:docker pull docker.cnb.cool/tencent/hunyuan/hunyuan-a13b:hunyuan-moe-A13B-vllm # 使用ModelScope下载的模型启动服务docker run  --privileged --user root  --net=host --ipc=host \        -v ~/.cache/modelscope:/root/.cache/modelscope \        --gpus=all -it --entrypoint python   docker.cnb.cool/tencent/hunyuan/hunyuan-a13b:hunyuan-moe-A13B-vllm \         -m vllm.entrypoints.openai.api_server --host 0.0.0.0 --tensor-parallel-size 4 \         --port 8000 --model /root/.cache/modelscope/hub/models/Tencent-Hunyuan/Hunyuan-A13B-Instruct-GPTQ-Int4/ --trust_remote_code

相比 DeepSeek-R1 较高的运行成本,这款 44GB 的 Hunyuan-A13B-Instruct-GPTQ-Int4 在数学、推理和 Agent 表现上值得进一步实测验证。

谷歌 Gemma 3n

谷歌 Gemma 家族再添新成员——面向端侧部署的轻量多模态模型 Gemma 3n

原生多模态支持:Gemma 3n 支持图像、音频、视频和文本输入,输出为文本结果
专为端侧优化:以高效运行为目标,提供 E2B 和 E4B 两种有效参数规模版本。虽然原始参数为 50 亿和 80 亿,但通过架构创新,实际内存占用相当于传统 20 亿和 40 亿参数模型,最低仅需 2GB(E2B)或 3GB(E4B)即可运行
架构创新亮点:包括 MatFormer 架构(增强计算灵活性)、逐层嵌入 PLE(提升内存效率)、LAuReL 与 AltUp(优化结构效率),以及专为移动端优化的新型音频编码器和基于 MobileNet-v5 的视觉编码器
综合性能出色:在多语言支持(覆盖 140 种文本语言和 35 种多模态语言理解)、数学、代码生成和逻辑推理方面均有显著提升。E4B 版本在 LMArena 基准测试中得分突破 1300,成为首个低于 100 亿参数却达到该水平的模型

全新大模型开源,腾讯(int4能打DeepSeek) Vs 谷歌(2GB运行多模态)图片最吸引人的点在于:极低成本即可实现端侧多模态推理

据网友实测反馈,Gemma 3n 的语音转写与翻译功能表现良好

但更值得关注的是其在移动端的实际运行表现

谷歌已将该模型上架安卓平台的 Edge Gallery 应用,结合其支持 GPU 卸载的特性,可能是目前最佳使用方式

不过有测试显示,在高通骁龙 6 代 4 核处理器(仅 CPU 运行)上每秒仅生成 4-5 个 token,响应较慢,实用性受限

目前建议持续关注,更多资源可自行查阅:

Hugging Face https://huggingface.co/collections/google/gemma-3n-685065323f5984ef315c93f4
Un

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
软件教程
相关文章 更多
AE基础教程:如何创建合成并制作关键帧动画
AE基础教程:如何创建合成并制作关键帧动画

本文指导After Effects新手完成从打开软件到制作简单动画的完整流程。内容涵盖新建合成、导入素材、添加关键帧及预览验证,适用于AE基础学习。读者可依据步骤快速完成首个可播放的动效项目。

电影剪辑实战:镜头组织、节奏控制与声音衔接技巧
电影剪辑实战:镜头组织、节奏控制与声音衔接技巧

本文详解电影剪辑核心流程,从素材整理、镜头空间组织到叙事节奏压缩,再到J-cut/L-cut声音衔接技巧。通过粗剪保逻辑、精剪压停顿、反应镜头缓冲及电平统一检查,帮助创作者打造空间清晰、情绪连贯且听感自然的成片。

转场剪辑实战指南:硬切、遮挡与运镜的精准选择与操作技巧
转场剪辑实战指南:硬切、遮挡与运镜的精准选择与操作技巧

本文详解硬切、遮挡转场和运镜转场的适用场景与操作逻辑。通过对比三种转场的核心区别,提供基于素材条件和叙事目的的判断标准,帮助剪辑师避免滥用特效,掌握自然衔接画面的实战技巧。

GitLab新手创建项目并推送第一次提交的操作指南
GitLab新手创建项目并推送第一次提交的操作指南

本文指导GitLab新手完成创建项目并推送第一次提交的最小闭环。涵盖远程项目创建、本地仓库初始化、添加远程地址及执行git push。重点说明HTTPS与SSH认证差异、分支名(master/main)核对及提交验证标准,确保远程仓库真正建立。

抖音拍摄剪辑教程:从竖屏运镜到卡点成片
抖音拍摄剪辑教程:从竖屏运镜到卡点成片

本教程针对抖音竖屏视频制作,涵盖拍摄前构思、稳定运镜、粗剪筛选、音乐卡点及导出检查全流程。重点在于拍摄时预留字幕空间、利用动作节点辅助剪辑,以及通过鼓点对齐画面。适用于新手快速完成第一条完整成片,强调素材质量与节奏自然,避免过度特效与版权风险。

饭圈舞台照修图:降噪、调色与人物突出技巧
饭圈舞台照修图:降噪、调色与人物突出技巧

针对饭圈舞台照光线乱、噪点多、背景抢眼的痛点,本文提供“保脸、控光、突出主体”的修图方案。核心步骤包括:利用Lightroom降噪面板处理高ISO颗粒,控制曝光避免高光死白或脸部死黑;通过压低背景色彩、提升人物亮度与对比度来修正舞台灯光导致的肤色偏差;最后通过裁剪去除杂乱元素,确保人物主体清晰且肤色自然。

Photoshop安装失败或启动异常:系统要求、安装流程与故障排查指南
Photoshop安装失败或启动异常:系统要求、安装流程与故障排查指南

本文提供Photoshop完整安装指南,涵盖Windows/macOS系统要求、Creative Cloud客户端部署及常见启动故障排查。通过安装前磁盘与账号检查、安装中网络监控、安装后功能测试三步法,解决安装中断、登录失败及启动卡顿问题,确保软件稳定可用。

创维电视通过U盘安装第三方软件完整教程:权限设置与故障排查
创维电视通过U盘安装第三方软件完整教程:权限设置与故障排查

本文提供创维电视通过U盘安装第三方APK的完整操作指南。核心步骤包括:准备格式化的U盘与正规APK文件,在酷开系统“应用管理”中找到安装入口,临时开启“允许安装未知来源应用”权限,以及安装后的功能测试与权限关闭。适用于解决电视无法识别U盘、提示解析失败或权限受限等问题,确保安装安全且不影响系统稳定。

Excel筛选大于指定数值:操作步骤与结果验证
Excel筛选大于指定数值:操作步骤与结果验证

本教程演示如何在Excel中筛选大于指定数值的数据。核心步骤包括:确保数据连续、选中表头、通过“开始→排序和筛选”开启筛选,并在“数字筛选”中选择“大于”输入阈值。筛选仅隐藏不符合条件的行,不删除数据。完成后需逐行验证可见数据是否均大于阈值,并可通过取消筛选恢复全部数据。

Creo零基础入门:新建零件与第一次拉伸建模完整指南
Creo零基础入门:新建零件与第一次拉伸建模完整指南

本教程指导Creo初学者完成首个拉伸实体建模。通过新建零件、选择mmns_part_solid模板、定义草绘平面及绘制封闭轮廓,生成三维实体。内容涵盖操作路径、参数设置及常见错误排查,帮助新手建立正确的建模逻辑与单位概念。

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。