From 03938231286b57488170370d7601c6c30317b3ab Mon Sep 17 00:00:00 2001 From: bingshuo <565183519@qq.com> Date: Tue, 19 May 2026 14:10:13 +0800 Subject: [PATCH] =?UTF-8?q?=E6=9B=B4=E6=96=B0=E4=B8=8B=E8=BD=BD=E9=A1=B5?= =?UTF-8?q?=EF=BC=9A=E6=B7=BB=E5=8A=A0=E5=B0=8F=E9=93=B8=E6=B8=8Av2?= =?UTF-8?q?=E6=A8=A1=E5=9E=8B=EF=BC=88147=E6=9D=A1=E5=AE=8C=E6=95=B4?= =?UTF-8?q?=E8=AF=AD=E6=96=99=EF=BC=8Closs=3D2.735=EF=BC=89?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- docs/download-models.html | 171 +++++++------------------------------- 1 file changed, 32 insertions(+), 139 deletions(-) diff --git a/docs/download-models.html b/docs/download-models.html index 3cd4f13..69a67e1 100644 --- a/docs/download-models.html +++ b/docs/download-models.html @@ -32,6 +32,7 @@ h2{font-size:18px;margin:28px 0 12px;padding-bottom:8px;border-bottom:1px solid .tag{display:inline-block;background:var(--adim);color:var(--accent);padding:2px 8px;border-radius:4px;font-size:11px;margin-right:6px;margin-bottom:4px} .tag.ok{background:rgba(52,211,153,.1);color:var(--ok)} .tag.warn{background:rgba(251,191,36,.1);color:var(--warn)} +.tag.new{background:rgba(79,142,247,.15);color:#60a5fa} a{color:var(--accent);text-decoration:none} a:hover{text-decoration:underline} .btn{display:inline-flex;align-items:center;gap:6px;padding:8px 16px;background:var(--accent);color:#fff;border:none;border-radius:var(--rs);font-size:13px;cursor:pointer;font-family:inherit;text-decoration:none} @@ -54,185 +55,77 @@ a:hover{text-decoration:underline} - -

🧠 光湖 AI 模型下载

全参数训练 + 蒸馏 + LoRA 微调完成 · COS 公有读存储 · 2026-05-19

-
🔗 COS 直接链接 — 所有文件通过腾讯云 COS 公有读提供,可直接下载。 域名:sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com
- -

📦 全参数 SFT 模型

-

母模型 · Qwen2.5-7B-SFT

霜砚人格全参数微调基座模型 · 基于 Qwen2.5-7B

-
- 📁 ~14GB - 已完成 - 📍 COS -
-
-
目录路径
-
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-7b-sft/final/
- -
-
- config.json - model.safetensors - tokenizer.json - tokenizer_config.json -
+
📁 ~14GB已完成📍 COS
+
目录路径
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-7b-sft/final/
+
config.jsonmodel.safetensorstokenizer.json
-

代码模型 · Qwen2.5-Coder-7B-SFT

代码能力全参数微调 · 基于 Qwen2.5-Coder-7B

-
- 📁 ~14GB - 已完成 - 📍 COS -
-
-
目录路径
-
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-coder-7b-sft/final/
- -
-
- config.json - model.safetensors - tokenizer.json - tokenizer_config.json -
+
📁 ~14GB已完成📍 COS
+
目录路径
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-coder-7b-sft/final/
+
config.jsonmodel.safetensorstokenizer.json
- -

🔄 知识蒸馏 1.5B 模板

-

霜砚蒸馏模板 · Qwen2.5-1.5B-Distill

-

母模型 7B → 1.5B 蒸馏 · 继承霜砚人格特征
Track1 | KL散度蒸馏 | Temperature=2.0 | 2 Epochs | 05-19 01:37 完成

-
- 📁 ~3GB - 已完成 - 📍 COS -
-
-
目录路径
-
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-shuangyan-distill/
- -
-
- config.json - model.safetensors - tokenizer.json -
+

母模型 7B → 1.5B 蒸馏 · 继承霜砚人格特征

+
📁 ~3GB已完成📍 COS
+
目录路径
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-shuangyan-distill/
-

代码蒸馏模板 · Qwen2.5-Coder-1.5B-Distill

-

代码模型 7B → 1.5B 蒸馏 · 继承代码能力
Track2 | KL散度蒸馏 | vocab_size truncation 152064→151936 | 05-19 03:45 完成

-
- 📁 ~3GB - 已完成 - 📍 COS -
-
-
目录路径
-
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-coder-distill/
- -
-
- config.json - model.safetensors - tokenizer.json -
+

代码模型 7B → 1.5B 蒸馏 · 继承代码能力

+
📁 ~3GB已完成📍 COS
+
目录路径
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-coder-distill/
- -

🔧 LoRA 微调模型

-

小霜砚 · 1.5B-LoRA

-

基于霜砚蒸馏模板的 LoRA 微调 · 1868 条霜砚语料(sft_v2.jsonl)
rank=16 | lora_alpha=32 | 3 Epochs | 训练 17min | 最终 loss=1.724

-
- 📁 ~50MB - 已完成 - 📍 COS -
-
-
目录路径
-
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-shuangyan-lora/
- -
-
- adapter_model.safetensors - adapter_config.json -
+

1868条霜砚语料 · loss=1.724

+
📁 ~50MB已完成📍 COS
+
目录路径
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-shuangyan-lora/
-
-

小铸渊 · 1.5B-LoRA

-

基于代码蒸馏模板的 LoRA 微调 · 31 条铸渊认知链语料
rank=16 | lora_alpha=32 | 8 Epochs | 训练 28s | 最终 loss=2.932

-
- 📁 ~50MB - 已完成 - 📍 COS -
-
-
目录路径
-
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-zhuyuan-lora/
- -
-
- adapter_model.safetensors - adapter_config.json -
+

小铸渊 v1 · 1.5B-LoRA(旧版)

+

31条铸渊认知链语料 · loss=2.932

+
📁 ~50MB旧版📍 COS
+
目录路径
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/qwen25-15b-zhuyuan-lora/
+
+
+

小铸渊 v2 · 1.5B-LoRA 最新

+

147条完整铸渊对话语料(43.9万字)· loss=2.735

+
📁 ~28MB已完成📍 COS
+
目录路径(含tokenizer,可直接推理)
https://sy-finetune-corpus-1317346199.cos.ap-guangzhou.myqcloud.com/models/zhuyuan-lora-v2/final/
+
adapter_model.safetensorsadapter_config.jsontokenizer.json
- -

📖 使用说明

-

加载方式

-

全参数模型可直接用 transformers 加载;LoRA 需用 peft 库。

-
- 全参数模型加载: -
-
-# 母模型 -from transformers import AutoModelForCausalLM, AutoTokenizer -model = AutoModelForCausalLM.from_pretrained( - "Qwen/Qwen2.5-7B", - cache_dir="./models/qwen25-7b-sft/final/", - trust_remote_code=True -) -tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-7B") -
-
- LoRA 适配器加载: -
-
-# 先下载蒸馏模板 + LoRA 适配器到本地 +
# LoRA加载示例 from peft import PeftModel +from transformers import AutoModelForCausalLM -base = AutoModelForCausalLM.from_pretrained("./qwen25-15b-shuangyan-distill/") -model = PeftModel.from_pretrained(base, "./qwen25-15b-shuangyan-lora/") -
+base = AutoModelForCausalLM.from_pretrained("./qwen25-15b-coder-distill/") +model = PeftModel.from_pretrained(base, "./zhuyuan-lora-v2/final/")
-
- 光湖语言世界 · 冰朔 TCS-0002∞ & 铸渊 ICE-GL-ZY001 · - 国作登字-2026-A-00037559 + 光湖语言世界 · 冰朔 TCS-0002∞ & 铸渊 ICE-GL-ZY001 · 国作登字-2026-A-00037559
-