通用候选
Qwen3-8B Q4
8.19B · Q4_K_M · 4.68 GiB0.778代码0.625核心0.778长上下文0.250推理0.500工具0.750翻译1.000
- 推荐用途
- 当前最适合作为默认本地通用/Agent 基线的模型。
- 注意事项
- 长上下文仅 0.250,并出现 2 次截断;仍需按任务选择。
视觉/多模态候选
gemma4:e4b
8.0B · Q4_K_M · 8.95 GiB0.736代码0.000核心0.736长上下文0.500OCR0.000推理0.400工具0.625翻译1.000视觉0.125
- 推荐用途
- 本机通用、翻译和长上下文任务的首选之一。
- 注意事项
- RC1 代码得分为 0;视觉绝对分也很低。
视觉/多模态候选
qwen3.5:9b
9.7B · Q4_K_M · 6.14 GiB0.694代码0.138核心0.694长上下文0.500医疗0.667OCR0.000推理0.400工具0.625翻译0.517视觉0.125
- 推荐用途
- 通用和长上下文任务的高质量候选。
- 注意事项
- 代码和翻译明显弱于同级候选,并有 9 次 final 前截断。
通用候选
Falcon-H1R-7B
7.59B · Q4_K_M · 4.28 GiB0.653代码0.375核心0.653长上下文0.250医疗0.667推理0.500工具0.625翻译0.950
- 推荐用途
- 推理、通用与医疗文本的稳健对照模型。
- 注意事项
- 代码得分 0.375,性能慢于若干 4B/混合架构模型。
通用候选
ornith:9b
9.0B · Q4_K_M · 5.24 GiB0.628代码0.762核心0.628长上下文0.250推理0.000工具0.500翻译0.933
- 推荐用途
- 代码、通用和翻译任务的强力本地候选。
- 注意事项
- 推理为 0,且尚未匹配到可信的精确官方模型卡。
通用候选
nemotron-3-nano:4b
4.0B · Q4_K_M · 2.64 GiB0.625代码0.500核心0.625长上下文0.250医疗0.833推理0.400工具0.375翻译0.733
- 推荐用途
- 4B 级通用、医疗文本和中速 Agent 任务的优先候选。
- 注意事项
- 翻译较弱且出现 1 次未知工具调用;医疗结果不代表临床安全。
视觉/多模态候选
qwen3.5:4b
4.7B · Q4_K_M · 3.16 GiB0.611代码0.300核心0.611长上下文0.250医疗0.500OCR0.100推理0.300工具0.625翻译0.533视觉0.125
- 推荐用途
- 4B 级通用、工具和轻量多模态候选。
- 注意事项
- 16 次 final 前截断;长输出必须显式控制。
通用候选
granite4.1:8b
8.8B · Q4_K_M · 4.98 GiB0.569代码0.375核心0.569长上下文0.250工具0.500翻译0.967
- 推荐用途
- 稳定的多语言通用助手与企业文本任务候选。
- 注意事项
- 代码与工具表现中等,不是本机这两项的第一选择。
推理候选
olmo-3:7b-think
7.3B · Q4_K_M · 4.17 GiB0.569代码0.750核心0.569长上下文0.250推理0.430翻译0.600
- 推荐用途
- 允许较长等待时的代码与推理研究。
- 注意事项
- 7 次 final 前截断和 1 次超时,不适合时间敏感交互。
视觉/多模态候选
qwen3-vl:8b
8.8B · Q4_K_M · 5.72 GiB0.569代码0.863核心0.569长上下文0.250OCR0.100推理0.400工具0.750翻译0.700视觉0.125
- 推荐用途
- 当前代码与工具任务很强的多模态候选。
- 注意事项
- 视觉仅 0.125,且有超时与 final 前截断;不要因模型名假定视觉可靠。
通用候选
olmo-3:7b-instruct
7.3B · Q4_K_M · 4.17 GiB0.528代码0.250核心0.528长上下文0.250工具0.500翻译0.933
- 推荐用途
- 开放研究、通用文本和翻译的可解释对照。
- 注意事项
- 代码 0.250,综合表现未达到本轮最强组。
视觉/多模态候选
ministral-3:8b
8.9B · Q4_K_M · 5.61 GiB0.486代码0.512核心0.486长上下文0.250OCR0.000工具0.625翻译0.967视觉0.125
- 推荐用途
- 均衡的多语言、代码、工具和多模态候选。
- 注意事项
- 视觉绝对分只有 0.125,速度也不占优。
通用候选
rnj-1
8.3B · Q4_K_M · 4.76 GiB0.403代码0.675核心0.403长上下文0.250工具0.625翻译0.933
- 推荐用途
- 响应快、适合代码、STEM 和翻译的实用模型。
- 注意事项
- 核心只有 0.403,仍需强提示和结果校验。
多模态/通用候选
gemma3n:e4b
6.9B · Q4_K_M · 7.03 GiB0.361代码0.000核心0.361翻译0.833
- 推荐用途
- 轻量翻译、摘要和普通文本任务。
- 注意事项
- 代码为 0,当前清单也未确认其多模态执行能力。
通用候选
granite4:7b-a1b-h
6.9B · Q4_K_M · 3.94 GiB0.361代码0.600核心0.361长上下文0.250工具0.625翻译0.917
- 推荐用途
- 速度优先的代码、翻译和工具调用候选。
- 注意事项
- 通用核心分仅 0.361,且精确上游制品映射仍需确认。
通用候选
mistral:7b
7.2B · Q4_K_M · 4.07 GiB0.361代码0.350核心0.361长上下文0.000工具0.250翻译0.900
- 推荐用途
- 稳定的传统 7B 多语言基线。
- 注意事项
- 工具 0.250、长上下文 0,已被更新模型在多项任务超过。
通用候选
Phi-4-mini GGUF
3.84B · Q4_K_M · 2.32 GiB0.361代码0.237核心0.361长上下文0.250工具0.000翻译0.800
- 推荐用途
- 低占用普通问答和翻译备选。
- 注意事项
- 代码 0.237、工具 0,复杂任务收益有限。
通用候选
llama3.2:3b
3.2B · Q4_K_M · 1.88 GiB0.278代码0.613核心0.278长上下文0.250工具0.625翻译0.867
- 推荐用途
- 轻量代码、工具调用和多语言文本。
- 注意事项
- 核心 0.278,复杂指令可靠性有限。
通用候选
phi4-mini
3.8B · Q4_K_M · 2.32 GiB0.278代码0.113核心0.278长上下文0.250医疗0.167工具0.000翻译0.833
- 推荐用途
- 快速普通文本与翻译备选。
- 注意事项
- 核心 0.278、代码 0.113、工具 0。
通用候选
smollm2:1.7b
1.7B · Q8_0 · 1.70 GiB0.236代码0.450核心0.236长上下文0.000工具0.125翻译0.783
- 推荐用途
- 低资源文本生成、翻译和简单代码草案。
- 注意事项
- 核心和工具较弱,并出现 5 次工具循环上限。
视觉/多模态候选
Granite Vision 4B
3.4B · Q4_K_M · 3.04 GiB0.194代码0.250核心0.194长上下文0.250OCR0.100工具0.000翻译0.883视觉0.125
- 推荐用途
- 轻量文档视觉集成实验和翻译。
- 注意事项
- 视觉 0.125、OCR 0.100,当前任务上未复现强文档理解。
推理候选
deepseek-r1:8b
8.2B · Q4_K_M · 4.87 GiB0.167代码0.750核心0.167长上下文0.250推理0.400工具0.125翻译0.950
- 推荐用途
- 适合容忍等待时间的代码与翻译辅助。
- 注意事项
- 2 次绝对超时、9 个运行异常及多次截断,不适合稳定交互默认模型。
推理候选
deepscaler:1.5b
1.8B · F16 · 3.32 GiB0.139代码0.613核心0.139长上下文0.000推理0.453工具0.000翻译0.717
- 推荐用途
- 快速推理或代码草案的低成本候选。
- 注意事项
- 通用、工具与长上下文结果弱;有 3 次截断。
通用候选
MiniCPM5-1B
1.1B · Q4_K_M · 0.64 GiB0.139代码0.688核心0.139长上下文0.000推理0.230工具0.500翻译0.850
- 推荐用途
- 超轻量、极高吞吐的代码和翻译候选。
- 注意事项
- 核心与推理较弱,并有 9 次截断和 2 次工具循环上限。
视觉/多模态候选
minicpm-v4.6
752.16M · Q4_K_M · 1.52 GiB0.097代码0.087核心0.097长上下文0.000OCR0.000推理0.400工具0.500翻译0.933视觉0.000
- 推荐用途
- 极快的翻译和轻量文本候选。
- 注意事项
- 视觉/OCR 为 0,且本地参数元数据存在身份异常。
推理候选
phi4-mini-reasoning
3.8B · Q4_K_M · 2.94 GiB0.097代码0.362核心0.097长上下文0.000推理0.400工具0.125翻译0.700
- 推荐用途
- 数学推理实验和轻量离线分析。
- 注意事项
- 9 次截断,核心、代码和工具表现均有限。
通用候选
SmolLM3-3B
3.08B · Q4_K_M · 1.81 GiB0.097代码0.125核心0.097长上下文0.000推理0.300工具0.000翻译0.850
- 推荐用途
- 小体积、快速翻译和轻量文本处理。
- 注意事项
- 核心、代码和工具表现弱,不宜承担复杂 Agent 工作。
通用候选
lfm2.5:8b
8.5B · Q4_K_M · 4.80 GiB0.072代码0.375核心0.072长上下文0.000推理0.500工具0.750翻译0.883
- 推荐用途
- 速度优先的工具调用与推理候选。
- 注意事项
- 核心仅 0.072、长上下文为 0,不适合作为通用默认模型。
推理候选
DS-R1-Qwen3-8B
8.19B · Q4_K_M · 4.68 GiB0.000代码0.613核心0.000长上下文0.000推理0.430工具0.000翻译0.917
- 推荐用途
- 离线推理或代码草案,适合允许失败重试的研究场景。
- 注意事项
- 核心为 0,2 次绝对超时、7 个异常和 13 次截断。