CoolFace
Apppublic

Iridescent7538/sparkle-server

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes
26 commits on main
9c0355b1y ago

✨ feat: 在流生成器中添加完整响应打印功能,增强调试信息

iridescent
37a74f81y ago

🐞 fix: 在 Dockerfile 中安装 llama.cpp 运行时所需的共享库

iridescent
4a070371y ago

🐳 chore: 在 Dockerfile 中添加 git 依赖,更新 README 文档以包含核心概念与配置建议

iridescent
81c15591y ago

📃 docs: 更新 README 文档,添加项目元数据和描述,增强可读性

iridescent
7dce2151y ago

🦄 refactor: 重构 Dockerfile 和 app.py,优化多阶段构建,增强模型加载和 API 逻辑,更新 README 文档以反映新特性

iridescent
ccb19d31y ago

🐳 chore: 更新模型配置为Qwen3系列8B,使用8位量化版本以优化性能和质量

iridescent
83bff9f1y ago

🐳 chore: 更新模型文件名以使用更高质量的Qwen3系列6位量化版本

iridescent
77dcb981y ago

🐳 chore: 更新模型文件名以使用更高质量的Qwen3系列量化版本

iridescent
6ec1f971y ago

🐳 chore: 在 Dockerfile 中添加 git 依赖以支持 llama-cpp-python 的安装

iridescent
a252a961y ago

🐳 chore: 更新依赖项版本,提升性能和兼容性

iridescent
65559ae1y ago

🐳 chore: 优化代码格式,更新模型文件名,移除不必要的导入

iridescent
7d718011y ago

🐳 chore: 在 requirements.txt 中添加 huggingface-hub 依赖

iridescent
1c078ac1y ago

🐳 chore: 更新 Dockerfile 以安装 llama-cpp-python 所需的编译工具,并移除 transformers 依赖

iridescent
7d8cfe91y ago

Merge branch 'quantization'

iridescent
0dc18371y ago

🐳 chore: 更新 transformers 版本至 4.52.4 以获取最新功能和修复

iridescent
701742d1y ago

🐳 chore: 更新为GGUF优化的Qwen3系列14B模型,调整API请求参数并更换依赖库

iridescent
5952add1y ago

🐳 chore: 更新模型为Qwen3系列14B,并配置4位量化以优化内存使用

iridescent
b98af2f1y ago

🐳 chore: 将用户输入格式化为指令提示,以优化模型问答效果

iridescent
0401a4b1y ago

🐳 chore: 更换模型为更强大的 "bigscience/bloomz-3b",并重新加入 torch.float16 以优化内存使用

iridescent
8b5a82e1y ago

🐳 chore: 更换模型为支持多语言的 "bigscience/bloomz-560m",并优化分词器设置以消除警告

iridescent
b141ea01y ago

🐳 chore: 更新模型为更强大的 "EleutherAI/gpt-neo-1.3B",并优化内存占用和性能

iridescent
243af861y ago

🐳 chore: 创建并授权缓存目录,以解决运行时权限问题

iridescent
ac6dd381y ago

🐳 chore: 更换基础镜像为更安全、更小的 Python 3.12-slim

iridescent
c24ce671y ago

🐳 chore: 将基础镜像版本升级至 Python 3.13.5,并设置 Hugging Face 缓存目录以避免权限问题

iridescent
1d3379a1y ago

🎉 init: Initial commit after project review and fixes

iridescent
ef1b34b1y ago

initial commit

Iridescent7538