🧠 模型管理中心
Ollama本地部署 · LoRA微调流水线 · 全生命周期DNA追溯
Ollama 已部署
28
含量化版本的模型标签
生产主力
v4.0
Llama-3.1-8B · Val 1.218
训练迭代
22
v3.7 → v4.1.6(持续)
模型磁盘占用
~715GB
models/ · 含训练中间产物
底座模型
4
Qwen2.5 / Llama3.1 / DeepSeek / Yi
训练数据
979-1273条
13知识域 · 家法主权强化
🔄 模型生命周期流水线
1. 底座模型
从HuggingFace/Ollama下载
→
2. LoRA微调
MLX LoRA rank=16
→
3. 合并权重
Merge → Fuse
→
4. GGUF转换
F16 → Q4_K_M量化
→
5. Ollama注册
Modelfile → ollama create
→
6. 生产部署
lh AI模型调用网关
📋 已部署模型注册表(Ollama)
生产
| 模型名称 | 标签 | 大小 | 类型 | 部署时间 |
|---|---|---|---|---|
| longhun-v4.0:latest | 主力Llama3.1-8B | 16 GB | 生产模型 | 6天前 |
| longhun-v4.0:q4 | Q4量化 | 4.9 GB | 生产模型 | 10天前 |
| longhun-v4.1.4:latest | 实验 | 18 GB | 实验模型 | 2周前 |
| longhun-v4.1.1-bind-antenna:latest | 天线绑定蚂蚁实验室 | 17 GB | 实验模型 | 2周前 |
| longhun-v4.1.1-bind:latest | 绑定 | 17 GB | 实验模型 | 2周前 |
| longhun-v4.1.1:latest | 实验 | 17 GB | 实验模型 | 2周前 |
| longhun-v4.1.0:latest | 实验 | 17 GB | 实验模型 | 2周前 |
| longhun-v4.0.7:experimental | 实验 | 17 GB | 实验模型 | 2周前 |
| longhun-v4.0.6:latest | 实验 | 17 GB | 实验模型 | 2周前 |
| longhun-v4.0.5:latest | 实验 | 17 GB | 实验模型 | 2周前 |
| longhun-v43-v3:latest | 蚂蚁v3 | 4.9 GB | 实验模型 | 9天前 |
| longhun-v43-v2:latest | 蚂蚁v2 | 4.9 GB | 实验模型 | 9天前 |
| longhun-v43:latest | 蚂蚁 | 4.9 GB | 实验模型 | 9天前 |
| longhun-v42-sys:latest | 系统 | 4.9 GB | 实验模型 | 9天前 |
| longhun-v42-v3:latest | v3 | 4.9 GB | 实验模型 | 9天前 |
| longhun-v42-v2:latest | v2 | 4.9 GB | 实验模型 | 9天前 |
| longhun-v41:latest | 实验 | 4.9 GB | 实验模型 | 10天前 |
| longhun-v3.8-expanded:latest | 扩展 | 986 MB | 轻量实验 | 10天前 |
| longhun-v3.8:latest | 稳定 | 3.1 GB | 轻量实验 | 10天前 |
| qwen2.5:1.5b | 底座 | 986 MB | 底座模型 | 3周前 |
| nomic-embed-text:latest | 274 MB | 嵌入模型 | 4周前 |
📜 训练迭代历史
v4.1.6 📍
正在训练中
最新迭代 · 持续优化 · 基于v4.1.5 checkpoint继续训练
训练中
v4.1.5
2026-08-05
优化参数迭代 · LoRA权重微调
v4.1.4
2026-07-28
重大实验 · 18GB Ollama部署 · 加入更多知识域数据
v4.1.3
2026-07-24
快速迭代 · 修复数据质量
v4.1.2
2026-07-23
精简实验 · 小LoRA快速验证
v4.1.1 / v4.1.1-bind / v4.1.1-bind-antenna
2026-07-22
关键实验 · 天线绑定分支 · 蚂蚁实验室联调 · 三路并行
v4.1.0
2026-07-20
训练数据扩充 · 新增知识域
v4.0.9
2026-07-18
精简训练 · LoRA小型化实验
v4.0.8
2026-07-17
精简训练实验
v4.0.7
2026-07-15
Ollama部署为experimental标签 · 17GB · 测试推理效果
v4.0.6
2026-07-14
17GB Ollama部署 · 实验标签
v4.0.5
2026-07-13
17GB · 训练优化迭代
v4.0.4
2026-07-11
34GB训练产物 · 参数调优
v4.0.3
2026-07-09
25GB · 训练策略调整
v4.0.2
2026-07-08
31GB · 首次迭代
v4.0 DeepSeek R1
2026-07-06
DeepSeek-R1-Distill-Llama-8B 底座 · 31GB LoRA训练产物
v4.0 天线分支
2026-07-05
蚂蚁实验室天线分支 · 17GB并行训练
v4.0 ⭐
2026-07-03
底座升级里程碑:Qwen2.5-1.5B → Llama-3.1-8B。979条训练样本,13知识域·家法主权。Val 1.218,16GB Ollama部署,当前生产主力。
主力
v3.7
2026-06-15
第一代主力:Qwen2.5-1.5B底座 · 1273条训练样本 · 13知识域 · Val 0.194 · 4.3GB Ollama部署 · 早停优化
归档
🏗️ 底座模型
🦙 Meta-Llama-3.1-8B-Instruct
Meta · HuggingFace · 8B参数
🤖 Qwen2.5-1.5B
阿里 · Ollama官方 · 1.5B参数
🧠 DeepSeek-R1-Distill-Llama-8B
DeepSeek · HuggingFace · 8B参数
🏯 Yi-1.5-9B-Chat
零一万物 · HuggingFace · 9B参数
⚙️ 训练配置参数
🔧 LoRA 配置
rank16
alpha64
dropout0.05
target_modulesq_proj, v_proj
🏋️ 训练超参
learning_rate1e-5
epochs8
batch_size4
optimizerAdamW
🧠 推理配置(当前主力 v4.0)
temperature0.7
top_p0.9
num_ctx4096
templateLlama3-Instruct
📊 量化配置
精度F16 → Q4_K_M
压缩比~3.3:1
v4.0 F1616 GB
v4.0 Q44.9 GB
💾 存储概览
📦 模型仓库总计
~715 GB
🏗️ 底座模型
31 GB
🏋️ 训练产物
~384 GB
📊 量化部署
~107 GB
🎮 快速操作