2026.09.24 · 周四工具
←返回首页话题 · Topic
#Qwen3
共 65 条相关资讯
2026.09.23 · 周三开源
TinyJev:596M 参数的离线决策模型发布
2026.08.30 · 周日开源
LocalLLaMA 用户集中发布多款大模型 GGUF 改造版本
2026.08.30 · 周日工具
社区开发者为 Mac 定制 Qwen3 推理方案:SSD 流式加载与稀疏注意力
2026.08.30 · 周日工具
Qwen3 2-bit 量化在 M5 Max 上跑 350K 上下文:速度与稳定性实测
2026.08.30 · 周日工具
NInfer fork:双 5090 跑通 Qwen3-27B 1M 上下文
2026.08.29 · 周六开源
社区推出 Qwen3-Next Flash 主线兼容量化版
2026.08.29 · 周六开源
ISTA-DASLab 发布 Qwen3.8-27B 最优 GGUF 量化
2026.08.28 · 周五工具
Qwen3-8B 实验:KV 缓存 q8 量化并非无损
2026.08.28 · 周五工具
Qwen3-Next 双卡推理测试:llama.cpp 与 ik_llama.cpp 性能对比
2026.08.27 · 周四工具
Qwen3.8 27B INT8 推理栈:4 张 MI100 跑到 972 tok/s
2026.08.26 · 周三开源
开源项目实现 GGUF 模型在 Axera NPU 上直接推理
2026.08.26 · 周三开源
Netra Runtime 开源 AMD MI350X 推理 kernel,Qwen3.6-35B-A3B 8 卡达 7.8 万 tok/s
2026.08.26 · 周三研究论文
SMITH:联合训练工具创建与使用的RL框架
2026.08.26 · 周三研究论文
重度量化 Qwen3 在 16GB 显卡上完成光学 TMM 编码,近百分钟 10.8 万 token
2026.08.26 · 周三开源
Qwen3 工具调用实测:Ornith-1.5 与 Tiel-Coder 并列居首
2026.08.25 · 周二工具
Llama.cpp 社区分支引入自适应投机解码,推理速度最高提升 50%
2026.08.24 · 周一工具
Qwen3-27B macOS 推理横评:MTPLX 综合最快,llama.cpp+MTP 紧随其后
2026.08.23 · 周日研究论文
Qwen3.8-27B 量化精度实测:4-bit 与 8-bit 差距悬殊
2026.08.23 · 周日开源
社区用户推出 Qwen3.8-27B MTP 移植版,声称可节省显存
2026.08.23 · 周日工具
单卡 RTX 5090 跑通 Qwen3-27B NVFP4:262K 上下文实测
2026.08.23 · 周日工具
用户移植 Ninfer 推理引擎至 CMP170HX 矿卡,35B 模型推理速度翻倍
2026.08.23 · 周日研究论文
本地跑大模型为何「变笨」:一篇推理精度实验拆解
2026.08.22 · 周六开源
Qwen3.8-27B 在 16GB 显卡上的量化与智能体实测
2026.08.22 · 周六工具
Llama.cpp 出现 DSpark PC Tree 推测解码分叉
2026.08.21 · 周五工具
MagicQuant 更新 Unsloth v3 量化流程,发布 Qwen3 27B 多档位 GGUF
2026.08.21 · 周五工具
Qwen3 8B 新 NVFP4 量化发布,Blackwell 上预fill 提速 50%
2026.08.20 · 周四工具
AirLLM 更新:支持 Qwen3.8-27B 与 Kimi K3,可在 4GB 显存下运行超大规模模型
2026.08.20 · 周四模型发布
社区实测:Qwen3.8-27B 知识召回能力较 3.6 出现明显下滑
2026.08.20 · 周四工具
Qwen3.8-27B 在 RTX 3090 上的推理优化:DFlash2 + 查找增强投机解码
2026.08.20 · 周四开源
DFlash2 推测解码加速 Qwen3 实测:推理速度最高提升约 3 倍
2026.08.20 · 周四开源
Superwhisper 开源 S1-mini:0.6B 参数的 ASR 文本规范化模型
2026.08.20 · 周四开源
Unsloth 推出 Qwen3.8-27B Dynamic v3.0 GGUF,同尺寸精度提升 10%
2026.08.19 · 周三研究论文
梯度累积并非中性的速度调节器:LoRA 实测对比
2026.08.19 · 周三工具
llama.cpp 拟新增稠密模型 CPU 卸载选项,可让 16GB 显存运行 27B 模型
2026.08.19 · 周三研究论文
FedPref:用联邦偏好学习实现放射报告结构化抽取
2026.08.17 · 周一工具
Qwen3.x 27B 在 Strix Halo 上实测:MTP 推测解码接近满命中率
2026.08.17 · 周一研究论文
MoE 分层敏感性研究:晚层可承受激进专家掩码
2026.08.17 · 周一工具
RTX 3090 单卡优化 Qwen3 28B 推理,单请求达 82 tps
2026.08.16 · 周日开源
Qwen3 27B 推理档位实测:xhigh 画质更佳但耗时约为 low 的 7 倍
2026.08.16 · 周日工具
M1 Max 本地跑 Qwen3 量化版,一句话生成网页俄罗斯方块
2026.08.16 · 周日工具
privibe:面向本地推理的 Mistral Vibe 隐私分支
2026.08.16 · 周日开源
Qwen3-27B 量化实验:哪些权重组真正决定质量
2026.08.16 · 周日开源
单卡 RTX 5090 跑 Qwen3-27B:NVFP4 量化达 880 tok/s
2026.08.16 · 周日研究论文
Qwen3.6 与 3.8 跨版本 Jacobian Lens 迁移实验
2026.08.15 · 周六工具
Qwen3.8-27B 混合精度 EXL3 量化发布:KL 散度低于 NVFP4 92%
2026.08.15 · 周六工具
Qwen3.8 GGUF 量化精度实测:Atomic 方案全面占优
2026.08.15 · 周六工具
NInfer 首发支持 Qwen3.8-27B:单卡 RTX 5090 达 200 tok/s
2026.08.14 · 周五工具
玩家用 RTX 5090 + 5060 Ti 本地跑通 2.4T 参数 Qwen3 MoE
2026.08.13 · 周四工具
Together AI 无服务器推理上线 Qwen3 系列模型
2026.08.12 · 周三工具
v100-skinny 内核让 V100 跑 Qwen3 27B 接近 366 t/s
2026.08.12 · 周三行业动态
ONESTRUCTION 联合 AWS 在 Qwen3 上构建建筑 IDS 专用基础模型
2026.08.11 · 周二产品功能
本地实测:Muse Glimmer 与 Qwen3 27B 编码能力对比
2026.08.10 · 周一研究论文
用 LLM 生成的评语预测标准化试题的通过率
2026.07.26 · 周日工具
三卡旧 GPU 跑 Qwen3 与 Gemma 量化模型:性能基准实测
2026.07.23 · 周四开源
社区发布 Qwen3 27B 精简模型 称可减少九成 token
2026.07.23 · 周四工具
4 张 RTX 3080 跑 Qwen3-27B 代码生成:69 tps 解码,成本约 2000 美元
2026.07.21 · 周二工具
Qwen3-27B NVFP4 在 RTX 5090 上的 MTP 实战测评
2026.07.21 · 周二开源
Qwen3.6-27B 推测解码横评:DFlash 领先,EAGLE3 在 vLLM 报错
2026.07.07 · 周二开源
ThinkingCap-Qwen3-27B 实验:声称推理 token 减半且精度持平
2026.07.03 · 周五研究论文
RLVR 训练小模型调用 Jira/Confluence API 的初步验证
2026.07.02 · 周四研究论文
AWS 研究:用符号执行轨迹训练小模型,代码缺陷检测反超四倍体量对手
2026.06.30 · 周二行业动态
用 Qwen3-1.7B 微调「求助小模型」,客服场景可少用约 25 倍大模型调用
2026.06.30 · 周二开源
NVIDIA 上架 Qwen3.6-27B NVFP4 量化权重
2026.06.30 · 周二开源
