M 贤紫精选模型市场
返回模型市场

Gemma 4 31B 本地 GGUF · UD-Q4_K_XL

代码 / Agent · Gemma 4 · UD-Q4_K_XL

Gemma4 Google 31B 稠密 GGUF 高质量

Google Gemma 4 31B-it(稠密)Unsloth 本地 GGUF,面向自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器的高强度本地推理。

本 SKU 规格

项目说明
文件名gemma-4-31B-it-UD-Q4_K_XL.gguf
量化UD-Q4_K_XL
体积约 17.5 GB
架构31B 稠密(Gemma 4 系列中偏 质量上限,推理慢于 26B-A4B MoE)
上下文最高约 256K(取决于内存与底座)
显存建议20 GB 起
后端llama.cpp / llama-server 或底座内置推理

适合做什么

  • 工作站 高质量对话、推理、代码与 Agent
  • 长上下文 阅读与复杂任务
  • 多模态:需下载 mmproj 配套 并按底座配置;仅主文件时以文本为主

26B-A4B:更快、更省显存,质量接近。31B(本条目):稠密全量,质量潜力更高。12B:更轻。按显存与速度选型。

推荐采样

--temp 1.0 --top-p 0.95 --top-k 64