DeepSeek-R1-Distill-Qwen-7B
Cloud LTE Studio 推理生态的核心基座模型 — 完整权重备份 + AgentFrame 官方基座。
Mirror of DeepSeek R1 Distill Qwen 7B weights, hosted by ljsysfurry.
Original: deepseek-ai/DeepSeek-R1-Distill-Qwen-7B
🚀 快速开始
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("ljsysfurry/DeepSeek-R1-Distill-Qwen-7B")
tokenizer = AutoTokenizer.from_pretrained("ljsysfurry/DeepSeek-R1-Distill-Qwen-7B")
🧠 AgentFrame 官方基座
本模型是 **AgentFrame**(Agent 专用 DeepSeek 推理框架)的默认本地基座。
AgentFrame 四层架构:
认知层 MetaCog — 任务分解 + 置信度追踪 + 信息缺口分析
路由层 LandmarkRouter — 块级稀疏检索 (HiLS 思路)
存储层 AbsorbedMLA — 吸收式 KV 缓存 + 分层量化 (270KB → 7.6KB, 35.6×)
物理层 KVPager — 热/温/冷三级换页 + 遗忘曲线驱逐
用 AgentFrame + 本基座,单卡 L40S 即可获得 138 万 token 上下文。
# AgentFrame 四层融合示例 (numpy 可跑)
git clone https://huggingface.co/ljsysfurry/AgentFrame
python3 agentframe_quad.py
相关资源:
🎨 生态 LoRA
基于本基座微调的 LoRA 适配器:
| LoRA | 内容 | 链接 |
|---|---|---|
| 小说续写 | 260K 字中文小说(空间折越)风格续写 | deepseek-r1-7b-novel-lora |
| 福瑞小说 | 《霄山》狼兽人教师原创故事,温暖治愈风 | deepseek-r1-7b-xiaoshan-lora |
from peft import PeftModel
model = PeftModel.from_pretrained(model, "ljsysfurry/deepseek-r1-7b-novel-lora")
📋 文件清单
model-00001-of-000002.safetensors/model-00002-of-000002.safetensors— 完整权重config.json/generation_config.json— 模型配置tokenizer.json— 分词器
本仓库为 DeepSeek R1 7B 的完整权重备份,遵循原模型 MIT 许可。
Cloud LTE Studio · 2026-08-10
- Downloads last month
- 81