2026.09.25 · 周五工具
←返回首页话题 · Topic
#本地部署
共 89 条相关资讯
2026.09.23 · 周三开源
K2-Horizon 系列模型 GGUF 量化版已上线 Hugging Face
2026.08.31 · 周一工具
社区实测:Qwen3.8-Flash-Next-NVFP4 与 27B-FP8 部署对比
2026.08.30 · 周日开源
DeepSeek V4 Flash 与 GLM 5.3 Flash 双卡 DGX Spark 实测对比
2026.08.29 · 周六开源
社区推出 Qwen3-Next Flash 主线兼容量化版
2026.08.29 · 周六研究论文
本地大模型为何不如官方版?实测:推理栈的每一层都在制造偏差
2026.08.29 · 周六工具
DGX Spark 实测:四款新模型本地部署性能对比
2026.08.29 · 周六工具
GGUF 量化文件名审计:443 个模型中 64 个精度虚标
2026.08.27 · 周四模型发布
社区称 GLM-5.3 Flash GGUF 版本可用
2026.08.27 · 周四工具
本地化代码库记忆引擎 Contextual 发布 Beta 版,接入 MCP
2026.08.26 · 周三模型发布
IBM 发布 Granite 4.2 开源模型,提供三种参数规格
2026.08.26 · 周三研究论文
重度量化 Qwen3 在 16GB 显卡上完成光学 TMM 编码,近百分钟 10.8 万 token
2026.08.26 · 周三开源
Qwen3 工具调用实测:Ornith-1.5 与 Tiel-Coder 并列居首
2026.08.25 · 周二行业动态
4060Ti 16GB 跑 27B 量化模型完成多轮编码任务
2026.08.25 · 周二研究论文
FreeToken 论文:用消费级显卡本地部署前沿 MoE 大模型
2026.08.24 · 周一行业动态
Qwen 27B 本地实测 Aider 跑分 72.9,追平 Gemini 2.5 Pro
2026.08.24 · 周一开源
250M 参数 LLM 量化至 60 MB,纯 CPU 即可运行
2026.08.24 · 周一工具
MTP 加速现已可用于 GLM-4.5-Air
2026.08.23 · 周日研究论文
Qwen3.8-27B 量化精度实测:4-bit 与 8-bit 差距悬殊
2026.08.23 · 周日模型发布
网友提前体验 Qwen 3.8 27B:称编码接近 GPT、OCR 优于 Gemini Flash Lite
2026.08.23 · 周日开源
用户微调 Gemma 12B,16GB 显存下工具调用提升 2.7 倍
2026.08.23 · 周日行业动态
Reddit 用户热议 Qwen 3.8 27B:闭源阵营集体沉默
2026.08.23 · 周日工具
单卡 RTX 5090 跑通 Qwen3-27B NVFP4:262K 上下文实测
2026.08.22 · 周六工具
社区实测 KV cache 分块拼接:256k 上下文预填充提速约 3 倍
2026.08.21 · 周五行业动态
Token 经济拐点:从 OpenClaw 到本地自研的 Agent 进化之路
2026.08.20 · 周四工具
CIYA v0.02 上线 Hacker News,主打提示词模板与确定性推理
2026.08.19 · 周三开源
Qwen 3.8 27B 被本地社区称为「DeepSeek 时刻」
2026.08.18 · 周二工具
H2AI Chat 开源:让多个 AI 在本地互相辩论
2026.08.17 · 周一模型发布
Qwen 3.8 27B 开源发布,默认推理等级过深需手动调低
2026.08.17 · 周一产品功能
Conw.ai:跑在一台 iMac 上的独立 AI 平台与开发者 API
2026.08.17 · 周一行业动态
社区分析:开源模型追赶前沿大模型的滞后时间正在缩短
2026.08.15 · 周六工具
Gemma 4 E4B 极低比特量化:推理能力恢复 96.74%
2026.08.15 · 周六工具
用户为 27B 模型自制「high」推理档位,推理长度缩至 xhigh 约五分之一
2026.08.15 · 周六行业动态
欧洲零售 GPU 价格一月内涨近两成
2026.08.15 · 周六模型发布
通义 Qwen3.8-27B 上线 LM Studio,支持本地部署
2026.08.15 · 周六产品功能
通义千问展示 Qwen3.8-27B 在 NVIDIA RTX Spark 上运行
2026.08.15 · 周六工具
Talos:以确定性内核为「裁决者」的本地 AI 代理
2026.08.15 · 周六工具
Qwen3.8 GGUF 量化精度实测:Atomic 方案全面占优
2026.08.15 · 周六工具
Atomic 发布 Qwen 27B 极限量化版:1-bit 压缩可在笔电运行
2026.08.15 · 周六模型发布
通义千问 Qwen3 系列实现 AMD 平台 day-zero 本地部署
2026.08.14 · 周五模型发布
通义千问 Qwen3.8-27B 开源发布,Unsloth 同步推出 GGUF 量化版
2026.08.14 · 周五模型发布
Qwen 3.8 或改为 27B 稠密架构,社区讨论本地部署影响
2026.08.14 · 周五工具
社区发布 Qwen 3.5/3.6/3.8 修复版聊天模板
2026.08.14 · 周五开源
开发者微调 1.5B 模型实现自然语言转 Shell 命令,已开源
2026.08.13 · 周四工具
DeepSeek V4 Flash 284B 单卡推理实测:drafter 放内存比放显存更快
2026.08.12 · 周三工具
社区开发者发布 Muse Glimmer 30B 多档 GGUF 量化版本
2026.08.12 · 周三开源
蚂蚁百灵开源 Ling-3.0-tiny:1.3B 激活参数跑出 25 分智能指数
2026.08.11 · 周二开源
Meta 开源 30B 本地 Agent 模型 Muse Glimmer
2026.08.11 · 周二产品功能
本地实测:Muse Glimmer 与 Qwen3 27B 编码能力对比
2026.08.11 · 周二开源
Meta 开源 30B 智能体模型 Muse Glimmer,可在 20GB 显存本地运行
2026.08.11 · 周二研究论文
Glimmer 搭配 Dflash 在 RTX 5090 上跑出 233 tps
2026.08.11 · 周二工具
DeepSeek V4 Flash 0731 在 DGX Spark 上的实测体验
2026.08.10 · 周一开源
Unsloth 上架 Muse-Glimmer-30B GGUF 量化版
2026.08.10 · 周一开源
Meta 开源 30B 模型 Muse Glimmer,瞄准本地智能体
2026.08.10 · 周一开源
Meta 开源 30B 模型 Muse Glimmer,主打本地常驻智能体
2026.08.10 · 周一工具
本地优先笔记 CLI 工具 chamber:让模型看不到文档 ID
2026.08.10 · 周一工具
RunOnMine:在本地为 AI 助手加一道安全策略边界
2026.07.31 · 周五工具
Collie:本地运行的 AI 编程代理,可操控浏览器与桌面
2026.07.30 · 周四开源
Unsloth 发布 Kimi K3 量化版本,最低 594GB 可本地运行
2026.07.29 · 周三开源
Unsloth 开始发布 Kimi K3 的 GGUF 量化文件
2026.07.28 · 周二开源
开发者开源极简本地 AI 智能体框架 Agent Mini
2026.07.28 · 周二行业动态
在消费级硬件上跑大模型:分布式推理的三条路径
2026.07.28 · 周二工具
社区推出 RTX 5090 专用推理引擎,单实例可达 720 token/s
2026.07.26 · 周日工具
开发者开源桌面端 TTS 工具:支持多模型切换与音色克隆
2026.07.26 · 周日工具
llama.cpp 全面支持 MCP,本地模型可实现代理式对话
2026.07.26 · 周日工具
开发者展示浏览器端 LFM 2.5 230M 推理达 1440 tok/s
2026.07.23 · 周四工具
开发者推出 USB 便携式 AI 代理:13 个工具、5 个 GGUF 模型,离线可用
2026.07.23 · 周四工具
MindControl:基于 llama.cpp 分支的推理过程注入引导工具
2026.07.22 · 周三工具
Ami:本地运行的个人 AI 代理正式开源
2026.07.22 · 周三行业动态
Laguna-S-2.1 本地实测:速度领先,但事实幻觉严重
2026.07.21 · 周二研究论文
arXiv 研究:九款 3B 以下开源模型系统评测,小模型经微调可胜任本地化结构化任务
2026.07.20 · 周一工具
Reddit 用户讨论:本地守门 + 云端推理的隐私架构是否已有先例
2026.07.20 · 周一工具
Chalie:开源本地 AI 智能体,在你离场时继续思考
2026.07.10 · 周五行业动态
本地大模型工具 Ollama 完成融资,活跃开发者超 900 万
2026.07.08 · 周三开源
Unsloth 上传 DeepSeek-V4-Flash 多尺寸 GGUF 量化版本
2026.07.08 · 周三工具
Qwen3.6-27B KV 缓存量化实测:Q6 不量化 KV 接近 Q8 水平
2026.07.07 · 周二行业动态
本地部署 LLM 时 prefill 速度常被忽视?社区讨论其 ROI 价值
2026.07.06 · 周一开源
开发者开源 Athena:纯本地四进程 C++ 语音助手
2026.07.03 · 周五工具
开源本地 AI 助手 Zynkbot 进入 v0.9 公测,主打透明记忆与本地优先
2026.07.02 · 周四工具
Kimi K2.7 Code 混合推理基准:Mac 加 RTX PRO 6000 的 RPC 实测
2026.07.02 · 周四工具
开源本地 AI 代理平台 Plurality 正式发布
2026.07.01 · 周三开源
社区上线 DeepSeek V4 Flash 多比特 GGUF 量化版
2026.06.30 · 周二产品功能
Hugging Face 新增按硬件兼容性筛选模型功能
2026.06.30 · 周二工具
Zeus:一款可本地运行的 AI Agent 编排器开源发布
2026.06.30 · 周二工具
Fleet 上线:本地优先的 Docker 化 Hermes AI Agent 管理控制台
2026.06.29 · 周一研究论文
社区测试:去拒绝训练后 MoE 模型数学与代码反超原版
2026.06.29 · 周一行业动态
社区实测:低量化大模型能否击败高量化小模型?
2026.06.28 · 周日开源
4×3090 实测 Step-3.7-Flash:全驻留量化反超更高级别,MTP 与视觉互斥
2026.06.28 · 周日开源
