Agents-A1 本地 GGUF · Q4_K_M
代码 / Agent · Agents-A1 · Q4_K_M
模型文件由第三方社区提供,贤紫精选模型市场仅提供索引与下载便利;使用请遵守该模型开源协议。
InternScience Agents-A1 官方 Q4_K_M GGUF:35B-A3B MoE 长程 Agent 模型,面向自研底座、小紫 AI 工作台与贤紫 AI 代码编辑器的本地 Agent 与改仓。
本 SKU 规格
| 项目 | 说明 |
|---|---|
| 文件名 | Agents-A1-Q4_K_M.gguf |
| 量化 | Q4_K_M |
| 体积 | 约 19.7 GB |
| 架构 | Qwen3.5 系 MoE(约 35B 总参、约 3B 激活),偏 Agent 地平线 训练 |
| 上下文 | 支持长上下文(实际上限取决于内存与底座;Agent 常用 8K~32K 起) |
| 多模态 | 需另下 mmproj 配套;仅主文件时为 文本 Agent |
| 显存建议 | 24 GB 起 |
| 后端 | 较新版本 llama.cpp / llama-server(须支持 qwen35moe 推理图) |
适合做什么
- 长程 Agent、工具调用、软件工程 / 改仓(与「只堆参数」的通用模型定位不同)
- 配合本机 SRX 做多步任务与落盘
- 图/视觉输入:加载 mmproj 后按 Qwen-VL 类方式配置(见底座文档)
显存不足可考虑同系列 Agents-A1-4B GGUF(另上架);追求精度可选 Q8_0 条目。
使用提示
- 请保持 llama.cpp / 自研底座 为支持 Agents-A1 架构的 较新构建,否则可能无法加载。
- 聊天模板以 Qwen3 / Agents-A1 官方为准;推理深度、thinking 等由底座参数控制。
下载与合规
主模型与 mmproj 见右侧两个下载按钮(跳转魔搭)。权重由 InternScience 提供,协议 Apache-2.0;贤紫精选市场仅提供索引与下载入口。