news 2026/2/4 18:41:10

ERNIE 4.5-A3B开源:210亿参数文本生成新引擎!

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
ERNIE 4.5-A3B开源:210亿参数文本生成新引擎!

ERNIE 4.5-A3B开源:210亿参数文本生成新引擎!

【免费下载链接】ERNIE-4.5-21B-A3B-Base-Paddle项目地址: https://ai.gitcode.com/hf_mirrors/baidu/ERNIE-4.5-21B-A3B-Base-Paddle

百度ERNIE系列再添新成员,210亿参数的ERNIE-4.5-21B-A3B-Base-Paddle模型正式开源,为文本生成领域带来新的技术突破和应用可能。

近年来,大语言模型(LLM)在参数规模和能力边界上持续突破,其中混合专家模型(Mixture of Experts, MoE)凭借高效的计算资源利用成为主流方向。随着开源生态的成熟,越来越多的企业选择开放核心模型,推动技术普惠与行业创新。据行业观察,2024年以来参数规模超过200亿的开源大模型数量同比增长150%,MoE架构模型占比提升至40%,成为高性能与资源效率平衡的优选方案。

ERNIE-4.5-21B-A3B-Base-Paddle作为百度最新开源的文本生成模型,核心亮点体现在三大技术创新:

异构MoE架构设计:模型采用210亿总参数配置,其中激活参数仅30亿,通过64个文本专家+64个视觉专家(共享2个专家)的异构结构,实现计算资源的智能分配。每个token仅激活6个专家进行处理,在保持高性能的同时显著降低推理成本,特别适合长文本处理场景。

超长上下文理解能力:模型支持131072 tokens的上下文长度(约26万字),远超常规模型的4k-32k范围,可处理完整书籍、代码库或长文档分析,为法律合同解析、学术论文生成等专业场景提供技术支撑。

全流程开源生态支持:基于PaddlePaddle深度学习框架构建,提供ERNIEKit工具包支持指令微调(SFT)、LoRA低秩适应和DPO偏好优化等全流程训练能力。开发者可通过简单命令完成模型下载与部署,单卡80G GPU即可实现基础推理服务。

该模型的开源将加速企业级文本生成应用的落地进程。在内容创作领域,超长上下文能力可支持小说续写、报告自动生成等场景;在代码开发领域,模型能理解完整项目结构并生成连贯代码;在企业服务方面,法律文档分析、金融报告摘要等专业任务的处理效率将大幅提升。尤为值得注意的是,百度采用Apache 2.0开源协议,允许商业使用,这为中小企业和开发者提供了低成本接入先进AI能力的机会。

【免费下载链接】ERNIE-4.5-21B-A3B-Base-Paddle项目地址: https://ai.gitcode.com/hf_mirrors/baidu/ERNIE-4.5-21B-A3B-Base-Paddle

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/2/4 23:48:49

NAS硬盘兼容性破解:第三方存储设备适配的技术方案

NAS硬盘兼容性破解:第三方存储设备适配的技术方案 【免费下载链接】Synology_HDD_db 项目地址: https://gitcode.com/GitHub_Trending/sy/Synology_HDD_db 当你尝试将高性价比的第三方硬盘接入群晖NAS时,是否频繁遇到"不兼容硬盘"的警…

作者头像 李华
网站建设 2026/2/3 19:54:08

FSMN-VAD自动化报告:检测结果导出PDF完整流程

FSMN-VAD自动化报告:检测结果导出PDF完整流程 1. 为什么需要导出PDF?——从语音片段到可交付报告 你已经成功运行了FSMN-VAD离线语音端点检测控制台,上传一段会议录音,几秒后右侧就弹出清晰的Markdown表格:第1段语音…

作者头像 李华
网站建设 2026/2/5 1:11:24

BSHM镜像支持40系显卡,CUDA 11.3已配好

BSHM人像抠图模型镜像:40系显卡开箱即用,CUDA 11.3已预装就绪 你是否还在为部署人像抠图模型反复折腾环境而头疼?装完TensorFlow又报CUDA版本不匹配,换显卡驱动后模型直接罢工,调试三天仍卡在ImportError: libcudnn.s…

作者头像 李华
网站建设 2026/2/5 2:28:54

ERNIE 4.5-VL:28B参数MoE多模态模型深度解析

ERNIE 4.5-VL:28B参数MoE多模态模型深度解析 【免费下载链接】ERNIE-4.5-VL-28B-A3B-Base-PT 项目地址: https://ai.gitcode.com/hf_mirrors/baidu/ERNIE-4.5-VL-28B-A3B-Base-PT 导语:百度正式推出ERNIE 4.5-VL-28B-A3B-Base-PT多模态模型&…

作者头像 李华
网站建设 2026/2/3 18:34:58

TeslaMate运维实战指南:从异常诊断到系统优化

TeslaMate运维实战指南:从异常诊断到系统优化 【免费下载链接】teslamate teslamate-org/teslamate: TeslaMate 是一个开源项目,用于收集特斯拉电动汽车的实时数据,并存储在数据库中以便进一步分析和可视化。该项目支持监控车辆状态、行驶里程…

作者头像 李华
网站建设 2026/2/3 17:45:20

VS Code后端开发效能倍增指南:从痛点诊断到工程化落地

VS Code后端开发效能倍增指南:从痛点诊断到工程化落地 【免费下载链接】vscode Visual Studio Code 项目地址: https://gitcode.com/GitHub_Trending/vscode6/vscode 1. 痛点诊断:5个致命效率瓶颈阻碍你成为顶级开发者 你是否曾遇到这些场景&…

作者头像 李华