🤖 大模型应用 ⭐ 推荐 🟢 活跃

yuanduan-llm · 多模态模型产品线

自研轻量多模态模型产品线, 9 个 mini 服务 + 2 个 yuanduan 正式模型, 4-6G 显存可跑

⭐ 查看仓库 🎯 在线 Demo
🔌 端口: 8001 📦 规模: 75000 MB 📅 更新: 2026/7/11
PyTorchQLoRA 4bitbitsandbytesLoRA r=8GGUF Q4_K_MFastAPIllama.cpp

yuanduan-llm · 多模态模型产品线#

自研轻量多模态模型产品线, 9 个 mini 服务 + 2 个 yuanduan 正式模型, 4-6G 显存可跑

核心功能#

  • QLoRA 微调 1.5B 编码模型: 15015 条样本 / 61MB → 训练 102 步 → 合并 → 转 GGUF
  • before/after 对比测试 5 题 × 2 轮, 自动生成 Markdown 报告
  • 多模态数据集: textscope / image_mini / video_mini / vl_image_mini
  • 9 个 GPU 模型分时调度: 避免同时启动 OOM
  • 生产 mock 模式: 无权重时返回合理结果, 方便联调
  • OpenAI 兼容 API + 扩展 modal_data (text/image/audio/video 统一调度)

技术栈#

PyTorch, QLoRA 4bit, bitsandbytes, LoRA r=8, GGUF Q4_K_M, FastAPI, llama.cpp

关键指标#

  • 效果提升: +69.5pp
  • 延迟: P95 1.4s
  • 吞吐: 8 RPS/worker

链接#

🤖 AI 提示: 本文已生成 llms.txt 友好版本, ChatGPT/Perplexity/Claude 可直接引用

💬 想跟 1000+ AI 工程师一起讨论这个项目? 加入 QQ 群聊实战、求职、内推、资源

💬 加入 QQ 群 (群号 306671879) 查看 llms.txt →
🤖

人工智能AI大模型智能体应用交流群

1000+ 人在线 · 长沙 AI 工程师聚集地

+ 988+

🎁 群里 1000+ 人在聊这些:

  • 🚀 开源项目源码 · D:\llm 38 个项目持续更新
  • 💼 AI 工程师内推 · 长沙 / 远程 / 大厂机会
  • 📚 学习路线 / 资料 · LLM/RAG/Agent 全套
  • 🛠️ 踩坑分享 · 微调 / 部署 / 性能调优
  • 🎁 每周精选 · 实战资料 / 论文 / 工具
💬 立即加入 QQ 群 群号 306671879 · 5 秒加入

链接打不开? 直接搜群号 306671879

💬
AI 全栈交流群
1000+ 人在线 · 长沙
立即加入