用戶名
UID
Email
密碼
登錄
自動登錄
找回密碼
註冊
首頁
Portal
XF NEWS
論壇
BBS
夯評測
REVIEW
嗑消息
TRENDS
瘋採訪
INTERVIEW
潮活動
賀得獎
校園活動
最新文章
搜索
搜索
熱搜:
XFastest 最夯的電腦領域
XFastest
夯評測
嗑新聞
瘋採訪
潮活動
速下載
本版
帖子
用戶
XFastest 最夯的電腦領域
»
論壇
›
官方推薦文章
›
業界動態 Industrial Information
›
NVIDIA 加速 Gemma 4 在 RTX PC 與 DGX Spark 的地端部 ...
返回列表
複製連結
發新帖
相關文章
RELATED
專為自駕計程車與自駕車打造的前沿開放模型 ...
顯示卡漲價潮擴大!亞洲市場傳最高調漲40%,R ...
怕 RTX 5090 又燒接頭!玩家自製防燒工具,單 ...
買 RTX 5090 竟綁一堆主機板!臺灣通路超狂組 ...
RTX 4080直接魔改32GB!中國二手市場大量出現 ...
96GB 顯卡價格近乎翻倍!NVIDIA RTX PRO 6000 ...
雕妹來了!技嘉推出 AORUS GeForce RTX 5060 ...
為何擴展 AI 運算效能需要 800 VDC 全新電力 ...
NVIDIA Nemotron 3.5 Lightning 與 NeMo Swit ...
夯評測
REVIEW
›
最強 AI 武裝!ROG Strix SCAR 18 (2026) G835 開箱測試 / 手動 320W 本地 Armor EdgeAI
電競全景高!ROG Cronox ARGB 機殼開箱組裝 / 4 x Eurux GR120 風扇與 9.2 吋 LCD 螢幕
3D 造景 x 散熱舞台!TCOMAS EXIT D3 PRO 水冷開箱測試 / 三面 LCD 螢幕、LYNK 磁吸風扇
一殼三玩、9 種電源位置!MONTECH TEN 機殼開箱 / 十週年模組化 M-ATX、多種安裝方式
iRocks T36 人體工學椅雙色開箱 / 晨光綠、丹寧藍簡約質感,4D 扶手與舒適支撐兼具
MSI MEG CORELIQUID E15 360 旗艦曲面水冷與 MAESTRO 900R 豪宅開箱測試
波紋 CP 有型!SAMA V42 BK 開箱組裝 / 波紋鋁框前門、USB-C 20Gbps、4顆 ARGB 流光風扇
新生報到!GIGABYTE EAGLE GL6J 開箱測試 / GiMATE AI 輔助文書筆電
RGB QD-OLED 第二彈!ROG Strix OLED XG34WCDMS 電競螢幕開箱 / 21:9, 1800R, 280Hz
雪白銀 x 慵懶雕妹!技嘉 B850 AORUS ELITE-P ICE 開箱測試 / 雕妹 ARI 塗裝、規格友善升級
文章精選
CHOICE
›
直立式數顯 M-ATX 九州風神 CH270 DIGITAL WH
「ROG Strix LC IV 360 ARGB」 - 塞滿主板開箱文。
全白濃縮!GIGABYTE B850M AORUS STEALTH ICE 背插主機板開箱評測
隨心所變,君主Montech TEN 可變機殼
真無線 x 中出管!ROG Strix SLC IV 360 ARGB LCD 一體式水冷開箱測試
夢想盒子Dream TV 12 Air電視盒-功能不縮水,價格更親民
最強 AI 武裝!ROG Strix SCAR 18 (2026) G835 開箱測試 / 手動 320W 本地 Armor EdgeAI
高CP值便宜千瓦白金白色登場 FSP 全漢 VITA 1000W PM
電競全景高!ROG Cronox ARGB 機殼開箱組裝 / 4 x Eurux GR120 風扇與 9.2 吋 LCD 螢幕
君主MONTECH TEN十周年紀念款機殼-緊湊型模組化設計加上組態變換,一顆機殼三種體驗
NVIDIA 加速 Gemma 4 在 RTX PC 與 DGX Spark 的地端部署推進代理 AI 應用
[業界新聞]
複製鏈接
打印
上一主題
下一主題
回復
電梯直達
1
#
6694
0
lin.sinchen
發表於 2026-4-8 18:45:53
|
只看該作者
|
只看大圖
|
倒序瀏覽
|
閱讀模式
開放模型正推動新一波裝置端 AI 浪潮,將創新從雲端延伸至日常裝置。隨著模型持續進化,其價值愈發取決於是否能存取地端即時脈絡資訊,將有意義的洞察轉化為可執行的行動。
為因應趨勢,Google 的 Gemma 4 家族系列加入全新模型,主打「小巧、快速、全能多模態(omni-capable)」,可在多種裝置上高效率地端運行。
Google 也與 NVIDIA 合作,將 Gemma 4 針對 NVIDIA GPU 進行最佳化,讓其可在多種系統上發揮高效能,涵蓋範圍包括資料中心部署、搭載 NVIDIA RTX 的 PC 與工作站、
NVIDIA DGX Spark
個人 AI 超級電腦,以及
NVIDIA Jetson Orin Nano
邊緣 AI 模組。
Gemma 4
:為
NVIDIA GPU
最佳化
的精巧模型
Gemma 4 開放模型家族的最新成員包含 E2B、E4B、26B 和 31B 等版本,專為從邊緣裝置到高效能 GPU 的高效率部署而設計。
所有配置均採用 Q4_K_M 量化、BS = 1、ISL = 4096 和 OSL = 128,在 NVIDIA GeForce RTX 5090 與 Mac M3 Ultra 桌上型電腦進行測試。Token 生成吞吐量數據是以 llama.cpp b7789 為基礎,並使用 llama-bench 工具測得。
新一代精巧模型可支援多種任務,包括:
推理:
在複雜問題解題任務中展示出色表現。
程式開發
:
面向開發者工作流程的程式碼生成與除錯。
代理
:
原生支援結構化工具使用(function calling)。
視覺、
影片
和音
訊
能力:
支援物件辨識、自動語音辨識,以及文件或影片理解等多模態互動。
交錯式多模態輸入:
可在單一指令中,以任意順序混合文字與影像。
多語言:
開箱即用,支援超過 35 種語言,並已在超過 140 種語言上進行預先訓練。
E2B 和 E4B 模型專為超高效率、低延遲的邊緣推理打造,可在包括 Jetson Nano 模組在內的多種裝置上,以接近零延遲的方式完全離線執行。26B 和 31B 模型則專為高效能推理與以開發者為中心的工作流程設計,非常適合代理 AI 任務。該批模型已針對 NVIDIA RTX GPU 和 DGX Spark 完成高效率運行準備,可用於驅動開發環境、程式助理及代理驅動的工作流程。
隨著地端代理 AI 持續升溫,OpenClaw 等應用使得 RTX PC、工作站和 DGX Spark 上「隨時待命」的 AI 助理成為現實。最新的 Gemma 4 模型也相容於 OpenClaw,讓使用者能建構從個人檔案、應用程式與工作流程中擷取脈絡的地端智慧代理,以實現任務自動化。
查看頁面了解
如何在 RTX GPU 和 DGX Spark 上免費運行 OpenClaw
,或查看
DGX Spark OpenClaw playbook
。如欲了解 Gemma 4 家族最新成員的更多資訊,請參閱
Google DeepMind 公告部落格
。
如何
開始?在
RTX GPU
和
DGX Spark
上運行
Gemma 4
NVIDIA 亦與 Ollama 和 llama.cpp 合作,為各款 Gemma 4 模型提供更完善的地端部署體驗。若要在地端使用 Gemma 4,用戶可以下載 Ollama 來運行 Gemma 4 模型,或安裝 llama.cpp,並搭配 Gemma 4 的 GGUF Hugging Face checkpoint 使用。此外,Unsloth 也同步支援,透過 Unsloth Studio 提供已最佳化與量化的模型,實現高效率的地端微調與部署。現在即可在 Unsloth Studio 中執行及微調 Gemma 4。
在 NVIDIA GPU 上運行 Gemma 4 系列等開放模型可獲得更理想的效能表現。NVIDIA Tensor Core 可加速 AI 推論工作負載,進而為地端運行提供更高吞吐量和更低延遲。同時 CUDA 軟體堆疊可確保與主流框架及工具廣泛相容,讓模型自發佈首日起即可高效率執行。
這樣的組合讓 Gemma 4 等開放模型可在多種系統上擴展部署,涵蓋範圍從邊緣端的 Jetson Orin Nano 到 RTX PC、工作站和 DGX Spark,都能在不需大量額外最佳化的情況下運行。
請參閱 NVIDIA
技術部落格
,了解如何在 NVIDIA GPU 上開始使用 Gemma 4 的更多細節,並進一步認識 NVIDIA 在
開放模型
領域的相關工作。
更多圖片
小圖
大圖
NVIDIA37.jpg
(51.9 KB, 下載次數: 46)
下載附件
保存到相冊
2026-4-8 18:45 上傳
組圖打開中,請稍候......
回復
使用道具
舉報
提升卡
置頂卡
沉默卡
喧囂卡
變色卡
顯身卡
發新帖
返回列表
複製連結
高級模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登錄後才可以回帖
登錄
|
註冊
本版積分規則
發表回復
回帖後跳轉到最後一頁
快速回復
返回頂部
返回列表