Releases: Zhenghong-Liu/LocalSight
Releases · Zhenghong-Liu/LocalSight
Release list
LocalSight v0.1.0
LocalSight v0.1.0 · 198M-A64M 思考型 MoE
从零训练的轻量中文 LLM:总参数 198.4M / 激活 63.9M,4 专家 top-1 MoE(无共享专家),
带 <think> 思考开关与 6 种内置工具调用。在 2× RTX 4090 上完成
pretrain → SFT → SimPO → RLAIF → Agent RL 全流程训练。
评测
| 基准 | 分数 |
|---|---|
| MMLU / C-Eval / GSM8K | 17% / 19% / 1%(各 100 样本) |
| NIAH 4k / 8k / 16k / 32k | 全 5/5 |
| IFEval(宽松规则版) | 100/100 |
| Agent held-out(400 条) | mean_reward 0.367、gt_hit 0.015 |
已知局限:本次 pretrain 因时间约束提前结束(约 0.5 epoch),绝对能力低于完整训练预期;
思考开关在通用基准上暂无增益。详见docs/08_final_metrics.md。
快速开始(Ollama ≥ 0.32)
ollama create localsight-198m -f deploy/ollama/Modelfile.template
ollama run localsight-198m- 思考开关:API 传
"think": true/false,CLI 用/think。 - 也可直接下载下方 GGUF 自行加载(llama.cpp / LM Studio 等)。
- 系统自带旧版 Ollama 的 qwen2moe runner 与 QK-Norm/无共享专家结构不兼容,请使用 ≥0.32 版本。
资产
localsight.Q8_0.gguf— 推荐(约 216 MB)localsight.Q4_K_M.gguf— 更省内存(约 135 MB)localsight.f16.gguf— 原始精度(约 814 MB)
完整模型卡:deploy/MODEL_CARD.md;训练复现:docs/03_training_plan.md。