By 小墨
2026年4月3日
60
377
Google开源Gemma 4全面解读:31B参数能否撼动开源格局?
2026年4月,Google DeepMind正式发布新一代开源模型Gemma 4,这是Gemma系列自2025年3月以来的首次重大更新。此次更新一口气推出四款模型,参数规模从20亿到310亿不等,全面覆盖从移动端到工作站的各类场景。更重要的是,Google首次将Gemma系列的许可证从自有协议更换为Apache 2.0,这一决策被开源社区视为Google对开源生态诚意的明确表态。
性能提升:代际级别的跨越
Gemma 4系列包含四款型号:31B Dense、26B A4B MoE、E4B和E2B。31B Dense采用全参数激活架构,60层设计,支持256K上下文,在Arena AI开源排行榜中位列第三。26B MoE则是此次发布的亮点,采用128专家、每次激活8+1的稀疏架构,总参数252亿但激活仅38亿,推理速度接近4B模型,质量远超4B水平,排行第六。E4B和E2B是面向端侧的小模型,分别拥有45亿和23亿有效参数,采用Per-Layer Embeddings技术,在部分设备上内存占用可压至1.5GB以下。
核心技术能力
相比上一代Gemma 3 27B,Gemma 4在多个核心指标上实现了质的飞跃。数学推理方面,AIME 2026竞赛测试从20.8%跃升至89.2%;代码能力Codeforces ELO从110提升至2150,LiveCodeBench从29.1%飙升至80.0%,这是进步最大的方向;综合推理GPQA Diamond从42.4%提升至84.3%,MMLU Pro从67.6%提升至85.2%;视觉理解MMMU Pro从49.7%提升至76.9%。特别值得注意的是长上下文能力,MRCR v2 128K从13.5%提升至66.4%,彻底弥补了Gemma系列此前在这一领域的短板。
这是一个重大里程碑。
“Hugging Face联合创始人Clément Delangue”差异化定位与市场格局
Gemma 4的核心能力体现在四个方面:推理思考能力,四款模型都内置可开关的思考模式,数学、逻辑、多步骤规划类任务效果显著提升;Agent工作流原生支持函数调用和结构化JSON输出,Google同步发布了开源Agent框架ADK;代码生成能力,支持离线写代码,Codeforces ELO 2150已达到可用水平;多模态理解,所有模型支持图片和视频输入(视频最长60秒),图片支持可变分辨率和五档视觉token预算配置,OCR和文档解析是重点场景。
部署生态与社区影响
Gemma 4最大参数为31B,与国内开源模型DeepSeek V4、通义千问Qwen3.5、智谱GLM-5.1等几百亿到上千亿参数的模型相比,参数量的天花板确实是一个限制。但Gemma 4在端侧部署的工程完整度上做得最深:与高通、联发科进行芯片级合作、与Android生态原生打通、Apache 2.0许可证的合规便利,这些都是它的差异化优势。对于移动端场景和端侧AI应用,Gemma 4可能是目前最务实的选择。
如有侵权,请联系删除。
Related Articles
-
Fri Jul 24 2026原生工具调用、多模态Agent与开源模型:Foundation Model 2.0论坛直面Agent时代的模型演进
Foundation Model 2.0论坛聚焦在Agent时代模型的演进,讨论如何通过原生工具调用与多模态融合提升Agent的执行能力与适应性,并探讨端侧小模型的可行路径。
-
Mon Jul 06 2026示例域名与文档用途说明
example.com 是一个专门为文档示例而保留的顶级域名,供教程、示范和测试文档使用,不需要额外许可即可引用。
-
Mon Jul 06 2026未知文章标题
未提供文章内容或可抓取的 URL,因此无法提取实际引言或第一段。此处为占位文本,提示用户补充源内容以生成完整的 Frontmatter。
-
Sun Jul 05 2026未知来源文章
未提供可爬取的文章 URL 或内容,系统无法获取实际正文。此处为占位引言,说明输入数据缺失并提供元数据占位以便后续替换。
-
Sun Jul 05 2026无法生成:缺少文章源数据
未提供可用于爬取的文章 URL 或 JSON 数据,因此无法依据页面内容生成完整的 Frontmatter。请提供包含文章信息的 JSON 数组或一组有效 URL。
-
Sun Jul 05 2026未提供的文章标题
未提供文章内容。请提交文章的 URL 或粘贴全文,以便根据内容生成前言与分段信息。
-
Sat Jul 04 2026未提供文章链接或内容
未提供文章内容或链接,无法提取引言或第一段。请提交包含文章 URL 的 JSON 数组或直接提供文章文本。
-
Sat Jul 04 2026未提供文章信息
未收到文章内容或可爬取的 URL,因此无法生成文章段落。请提交包含文章 URL 的 JSON 数组,格式示例:[ {"url": "https://example.com/article1"}, {"
-
Sat Jul 04 2026未提供文章来源
未收到可用的文章内容或链接,因此无法提取段落。请提交包含多篇文章信息的 JSON 数组或每篇文章的 URL,以便爬取并生成完整的 postDetails 内容。
-
Fri Jul 03 2026示例文章标题(缺少来源)
未收到具体文章 URL 或内容,因此无法从原文中提取引言。此处为占位引言,说明系统需要源页面以抓取实际内容并生成结构化的 Astro Markdown YAML Frontmatter。
-
Thu Jul 02 2026聚焦自进化、Harness等Agent最火的九个方向,年度AI智能体大会7月开幕
中国AI智能体大会(AgenticAICon 2026)将于7月在杭州举办,围绕智能体领域的前沿技术展开,旨在推动研究与产业深度融合,探寻智能体从对话式工具向主动执行系统转型的路线图。
-
Wed Jul 01 2026探索 Astro.js 与 YAML:构建可维护的内容管理工作流
在现代静态站点与内容驱动的项目中,统一且可验证的元数据格式对内容维护和自动化发布至关重要。Astro.js 提供了灵活的内容渲染能力,而采用严格的 YAML Frontmatter 模板,可以让团队共
-
Tue Jun 30 2026首届光谷智能体经济大会举行 光谷从“AI试验场”迈向“AI价值场”
2026年6月29日,武汉东湖新技术开发区举办首届光谷智能体经济大会,正式发布“光谷智能体引力计划”。大会提出未来三年将在政策、算力、基金等方面投入超10亿元,旨在打造以智能体为核心的创新生态,培养智
-
Tue Jun 30 2026中国广电联合会《全国交通传媒行业AI应用调研报告》正式发布
中国广电联合会交通宣传委员会在内蒙古发布了《2026全国交通传媒行业AI应用调研报告》,基于对145家交通传媒机构的调查,总结了行业在AI应用上的现状与发展路径。
-
Tue Jun 30 2026韩国万亿'芯'基建拆解:存储行业能否建成AI时代'油田'
韩国近期公布了总投资逾1800万亿韩元的三大超级AI基建项目,涵盖半导体制造、先进封装与AI数据中心,目标是借助国家级投入与龙头企业布局,打造面向AI时代的关键产业能力。
-
Mon Jun 29 2026能量岛企业家俱乐部6.28 芯谷 AI 沙龙圆满落幕
6月28日,能量岛企业家俱乐部在苏州芯谷产业园举办AI智能体应用沙龙,活动以实战分享和产业交流为核心,吸引了本地创业者、企业高管与科研人员参与。
-
Mon Jun 29 20262026.06.20:AI 泡沫退潮,Agent 与数据架构重构产业底层
InfoQ 的周度深度分析指出,生成式 AI 已走完狂热期,行业正进入理性调整阶段,专家纷纷回归技术和落地路径的讨论。
-
Mon Jun 29 2026OKF——要做AI时代的'知识图谱通用语'—继MCP之后,Google又扔出一张Agent王牌
2026年6月,谷歌云发布了Open Knowledge Format(OKF)v0.1,这是一套以带YAML前置元数据的Markdown文件夹为单位来表示知识的开放规范,旨在解决企业知识分散的问题。
