DeepSeek-R1-Distill-Qwen-7B

Cloud LTE Studio 推理生态的核心基座模型 — 完整权重备份 + AgentFrame 官方基座。

Mirror of DeepSeek R1 Distill Qwen 7B weights, hosted by ljsysfurry.

Original: deepseek-ai/DeepSeek-R1-Distill-Qwen-7B


🚀 快速开始

from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("ljsysfurry/DeepSeek-R1-Distill-Qwen-7B")
tokenizer = AutoTokenizer.from_pretrained("ljsysfurry/DeepSeek-R1-Distill-Qwen-7B")

🧠 AgentFrame 官方基座

本模型是 **AgentFrame**(Agent 专用 DeepSeek 推理框架)的默认本地基座。

AgentFrame 四层架构:

认知层 MetaCog        — 任务分解 + 置信度追踪 + 信息缺口分析
路由层 LandmarkRouter — 块级稀疏检索 (HiLS 思路)
存储层 AbsorbedMLA    — 吸收式 KV 缓存 + 分层量化 (270KB → 7.6KB, 35.6×)
物理层 KVPager        — 热/温/冷三级换页 + 遗忘曲线驱逐

用 AgentFrame + 本基座,单卡 L40S 即可获得 138 万 token 上下文。

# AgentFrame 四层融合示例 (numpy 可跑)
git clone https://huggingface.co/ljsysfurry/AgentFrame
python3 agentframe_quad.py

相关资源:


🎨 生态 LoRA

基于本基座微调的 LoRA 适配器:

LoRA 内容 链接
小说续写 260K 字中文小说(空间折越)风格续写 deepseek-r1-7b-novel-lora
福瑞小说 《霄山》狼兽人教师原创故事,温暖治愈风 deepseek-r1-7b-xiaoshan-lora
from peft import PeftModel
model = PeftModel.from_pretrained(model, "ljsysfurry/deepseek-r1-7b-novel-lora")

📋 文件清单

  • model-00001-of-000002.safetensors / model-00002-of-000002.safetensors — 完整权重
  • config.json / generation_config.json — 模型配置
  • tokenizer.json — 分词器

本仓库为 DeepSeek R1 7B 的完整权重备份,遵循原模型 MIT 许可。


Cloud LTE Studio · 2026-08-10

Downloads last month
81
Safetensors
Model size
8B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for ljsysfurry/DeepSeek-R1-Distill-Qwen-7B

Adapters
1 model