24 8 月 2026

Google宣布 Gemma 4 開放人工智慧模型,過渡到 Apache 2.0 許可證

Google宣布 Gemma 4 開放人工智慧模型,過渡到 Apache 2.0 許可證

谷歌的 Gemini AI 模型在過去一年中得到了顯著改進,但你只能按照谷歌的條款使用 Gemini。該公司的開放重量 Gemma 型號提供了更多的自由度,但一年多前推出的 Gemma 3 有點長。從今天開始,開發人員可以開始使用 Gemma 4,它有四種尺寸可供本地使用最佳化。谷歌也承認開發者對人工智慧授權感到沮喪,因此它正在取消客製化的 Gemma 許可。

與先前版本的開放重量模型一樣,Google 將 Gemma 4 設計為可在本地設備上使用。當然,這可能意味著很多事情。 Gemma 的兩個大型版本,26B Mixture of Experts 和 31B Dense,專為在 80GB Nvidia H100 GPU 上以 bfloat16 格式進行非量化播放而設計。當然,這是一款價值 2 萬美元的人工智慧加速器,但它仍然是一款國產設備。如果擴展到以較低解析度運行,這些較大的模型將適合消費級 GPU。

谷歌還聲稱專注於減少延遲,以真正利用 Gemma 的本地處理。 26B 專家混合模型在推理模式下僅啟動 260 億個參數中的 38 億個,使其每秒的程式碼量明顯高於類似大小的模型。同時,31B Dense 更多的是品質而不是速度,但谷歌希望開發人員針對特定用途進行最佳化。

另外兩個 Gemma 4 型號 Efficient 2B (E2B) 和 Efficient 4B (E4B) 則是針對行動裝置。這些選項旨在在推理過程中保持較低的記憶體使用量,以 20 億或 40 億個有效參數運行。 Google表示,Pixel 團隊與高通和聯發科密切合作,為智慧型手機、Raspberry Pi 和 Jetson Nano 等裝置優化這些模型。它們不僅比 Gemma 3 使用更少的記憶體和電池,而且谷歌這次還宣稱「接近零延遲」。

更強大、更開放

據報道,所有新的 Gemma 4 型號都將讓 Gemma 3 望塵莫及,谷歌聲稱這些是您可以在本地硬體上運行的最強大的型號。 Google表示,Gemma 31B 首次亮相後將在 Arena 最佳開放 AI 模型清單中排名第三,僅次於 GLM-5 和 Kimi 2.5。然而,即使是最大版本的 Gemma 4 也只是這些模型尺寸的一小部分,這使得它們理論上的操作成本要低得多。


發布日期: 2026-04-02 17:01:00

來源連結: arstechnica.com

Copyright © All rights reserved. | Newsphere by AF themes.