2026.07.30 · 周四开源
←返回首页话题 · Topic
#GGUF
共 13 条相关资讯
2026.07.30 · 周四工具
llama.cpp 默认加载 MTP 张量,即便未启用推测解码也会占用额外显存
2026.07.29 · 周三工具
Kimi 大模型 GGUF 本地推理实测:速度仅 0.23 tok/s
2026.07.29 · 周三开源
Unsloth 开始发布 Kimi K3 的 GGUF 量化文件
2026.07.29 · 周三工具
社区展示 90GB 显存 LoRA 直训 284B 模型方案
2026.07.26 · 周日开源
POCKET-35B 发布:可在无 GPU PC 和手机上运行的 35B 模型
2026.07.26 · 周日工具
三卡旧 GPU 跑 Qwen3 与 Gemma 量化模型:性能基准实测
2026.07.23 · 周四工具
开发者推出 USB 便携式 AI 代理:13 个工具、5 个 GGUF 模型,离线可用
2026.07.08 · 周三开源
Unsloth 上传 DeepSeek-V4-Flash 多尺寸 GGUF 量化版本
2026.07.01 · 周三开源
社区上线 DeepSeek V4 Flash 多比特 GGUF 量化版
2026.06.30 · 周二开源
Bartowski 发布 DeepSeek-V4-Flash 的 GGUF 量化版本
2026.06.30 · 周二工具
社区发布 Qwen3.5/3.6 MTP 张量 GGUF 子集
2026.06.28 · 周日开源
