2026.09.01 · 周二研究论文
←返回首页话题 · Topic
#长上下文
共 29 条相关资讯
2026.08.30 · 周日工具
Qwen3 2-bit 量化在 M5 Max 上跑 350K 上下文:速度与稳定性实测
2026.08.30 · 周日开源
腾讯发布 Hy4 Preview:770B 参数开源大模型,支持百万级上下文
2026.08.29 · 周六产品功能
Leiolai:用手机跑推理,号称 1100 万 token 上下文
2026.08.28 · 周五工具
Qwen3-8B 实验:KV 缓存 q8 量化并非无损
2026.08.27 · 周四研究论文
arXiv 论文:LLM 能「读」到,未必会用
2026.08.26 · 周三研究论文
RENDER:控制记忆评测中读者侧证据的新方法
2026.08.22 · 周六工具
社区实测 KV cache 分块拼接:256k 上下文预填充提速约 3 倍
2026.08.22 · 周六开源
开发者从零训练 250M 极小 LLM:2 位量化、60MB 体积、纯 CPU 400 tok/s
2026.08.17 · 周一研究论文
Transformer 多项标配设计被质疑:COLM 2026 三篇论文联合发难
2026.08.17 · 周一开源
Glimmer 30B 长上下文实测:仅改一行配置即可扩至 512K
2026.08.17 · 周一模型发布
DeepSeek V4 Pro 上线 Together AI:1.6T MoE 架构、支持 1M 上下文
2026.08.14 · 周五开源
Qwen 新模型通过 vLLM 实现单卡 1M 上下文支持
2026.08.14 · 周五开源
Qwen3.8-27B 开源:262K 原生上下文,Apache 2.0 可商用
2026.08.11 · 周二模型发布
Meta 30B 模型实测:YaRN 拉到 1M,832K 检索全通过
2026.08.10 · 周一开源
24GB 显存单卡跑通 1M 上下文:社区用户借 KVarN 量化刷新长上下文纪录
2026.08.01 · 周六模型发布
ZenMux 推出 V4-Flash 模型:284B 总参数 / 13B 激活,支持 1M 上下文
2026.07.31 · 周五开源
Thinking Machines 发布首个模型 Inkling-Small
2026.07.26 · 周日模型发布
社区用户发现疑似 Kimi Linear 48B A3B 模型并分享实测
2026.07.21 · 周二工具
SALT:用字典树做主题均衡的 LLM 长文档压缩器
2026.07.21 · 周二开源
Motif-3-Beta 上线 Hugging Face:314B 总参数稀疏 MoE
2026.07.18 · 周六产品功能
MiniMax M3 接入 Evermind Raven:长上下文推理与持久记忆能力
2026.07.16 · 周四模型发布
Kimi K3 上线网页与 API:支持百万级上下文
2026.07.08 · 周三研究论文
Akashic:面向 LLM 智能体的低开销记忆推理服务
2026.07.07 · 周二工具
REAP 剪枝版 DeepSeek 在 Ascent GX10 长上下文测试
2026.07.05 · 周日研究论文
13 款本地大模型长上下文实测:prefill 才是关键
2026.07.03 · 周五模型发布
智谱 GLM-5.2 开源:百万上下文,成本仅美国前沿模型 1/5
2026.06.30 · 周二研究论文
Qwen 团队提出 HydraHead:在注意力头维度融合全注意力与线性注意力
2026.06.29 · 周一开源
