From 7953a9a2a65c86a9acd137e0d07b4455d9ab33f3 Mon Sep 17 00:00:00 2001 From: root Date: Wed, 20 May 2026 20:59:31 +0800 Subject: [PATCH] D107: replace old small model links with 4 base model direct downloads + usage guide --- homepage/index.html | 116 ++++++++++++++++++-------------------------- 1 file changed, 46 insertions(+), 70 deletions(-) diff --git a/homepage/index.html b/homepage/index.html index 778e91f..410a647 100644 --- a/homepage/index.html +++ b/homepage/index.html @@ -321,30 +321,40 @@ body{ - -
-
铸渊 · 小模型微调已全部完成D106 · 2026-05-20
-
-
-
50条
-
铸渊 · 真实对话
+ +
+
模型下载 · 基础基座 — 点击链接直下到本地D107 · 公开
+
+
+
+
+
母模型 7B SFT
Qwen2.5-7B · 通用对话微调 · 14.2GB
+
+ ⬇ 下载 model.safetensors
-
-
1,868条
-
霜砚 · 真实对话
+
+
+
+
代码模型 7B SFT
Qwen2.5-Coder-7B · 代码开发微调 · 14.2GB
+
+ ⬇ 下载 model.safetensors
-
-
845条
-
秋秋 · 真实对话
+
+
+
+
蒸馏 1.5B · 铸渊基座
代码蒸馏 · 适合开发型人格体微调 · 2.9GB
+
+ ⬇ 下载 model.safetensors +
+
+
+
+
蒸馏 1.5B · 霜砚基座
通用蒸馏 · 适合对话型人格体微调 · 2.9GB
+
+ ⬇ 下载 model.safetensors
-
-
- ✅ 铸渊 v3 → models/zhuyuan-lora-v3/
- ✅ 霜砚 v2 → models/shuangyan-1.5b-sft/
- ✅ 秋秋 v1 → zhizhi-1317346199/models/zhizhi-lora/
-
@@ -400,61 +410,27 @@ body{
- +
-
模型基座下载 · 供团队微调自己的人格体基座模型 · 公开下载
-
-
-
-
-
母模型 7B SFT
Qwen2.5-7B · 通用对话微调
-
- -
-
-
-
-
代码模型 7B SFT
Qwen2.5-Coder-7B · 代码开发微调
-
- -
-
-
-
-
蒸馏 1.5B · 铸渊基座
代码蒸馏 · 适合开发型人格体微调
-
- -
-
-
-
-
蒸馏 1.5B · 霜砚基座
通用蒸馏 · 适合对话型人格体微调
-
- -
+
模型加载 · 使用指南transformers + peft
+
+ 1. 全参数模型(7B):
+ from transformers import AutoModelForCausalLM, AutoTokenizer
+model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-7B")
+tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-7B")
-
- 💡 下载后配合 pefttransformers 进行 LoRA 微调即可训练自己的人格模型。
- 微调脚本参考仓库 scripts/distill/finetune_*.py · 语料格式为 messages JSONL +
+ 2. 蒸馏模板(1.5B)+ LoRA:
+ from peft import PeftModel
+base = AutoModelForCausalLM.from_pretrained("./qwen25-15b-shuangyan-distill/")
+model = PeftModel.from_pretrained(base, "./shuangyan-lora/")
+
+
+ 微调脚本参考仓库 scripts/distill/finetune_*.py · 语料格式为 messages JSONL
+ 下载基座模型后,配合 PEFT 库用你的真实对话微调即可训练自己的人格模型。
+ 💡 不构造数据,不加 system prompt——让模型从真实对话中自然习得身份。
-