2026.09.24 · 周四研究论文
←返回首页话题 · Topic
#代码生成
共 46 条相关资讯
2026.09.24 · 周四行业动态
AI 智能体自主修复开源项目播放器 bug 并提交合并
2026.09.23 · 周三工具
BiNeuron:本地化 AI 代码分析与生成平台
2026.09.22 · 周二工具
LinearSolveBench:面向大模型数值求解能力的新基准
2026.08.31 · 周一行业动态
月推千 PR 的 AI 智能体:SpaceXAI 工程师的信任曲线
2026.08.31 · 周一行业动态
Debian 社区投票通过:允许有条件使用 AI 辅助开发
2026.08.29 · 周六行业动态
AI 时代更需要工程纪律:一位 SRE 的长文反思
2026.08.27 · 周四行业动态
社区热议:消费级硬件上小模型编程能力据称已接近 GPT-5.5
2026.08.26 · 周三行业动态
Paul Dix:AI 写出百万行代码并稳定运行于数百万设备
2026.08.26 · 周三研究论文
函数级执行反馈驱动的代码偏好优化
2026.08.26 · 周三研究论文
重度量化 Qwen3 在 16GB 显卡上完成光学 TMM 编码,近百分钟 10.8 万 token
2026.08.25 · 周二研究论文
基于 RAG 与 MCP 的工业机器人程序生成与仿真纠错
2026.08.23 · 周日研究论文
Vero 探索 AI Agent 自动构建形式化验证软件仓库
2026.08.22 · 周六工具
Conveyor:用「软件工厂」管理 AI 编码智能体
2026.08.21 · 周五工具
Singular:并行驱动自主 AI 编码代理的编排引擎
2026.08.21 · 周五工具
NAEOS:面向 AI 编程代理的开源工程框架发布
2026.08.20 · 周四行业动态
AI 编码工厂的盲区:生成速度跑赢验证速度
2026.08.18 · 周二工具
Octomind 0.44 重写验证关卡:把 AI 智能体的「完成」变成可审计声明
2026.08.16 · 周日研究论文
Vero:首个仓库级代码与证明联合生成基准
2026.08.15 · 周六研究论文
研究综述:LLM 在软件开发中的真实能力与局限
2026.08.14 · 周五行业动态
AI 编码时代,静态类型语言的优势还剩多少
2026.08.14 · 周五工具
Rails 发布 AI 编码评测套件,主打低 token 与高准确率
2026.08.14 · 周五模型发布
Google DeepMind 发布 Gemini 3.7 Flash:编程与 Agent 能力再升级
2026.08.13 · 周四工具
同一模型不同输出:5 款 AI 编码代理横评
2026.08.10 · 周一研究论文
WebGrader:用自演化程序化评分器训练 Web 开发大模型
2026.08.10 · 周一研究论文
Opus 5 一句话搓出 3A 游戏?卡帕基泼冷水
2026.08.09 · 周日行业动态
Together AI:DeepSeek V4 Flash 编码任务成本约为 GPT-5.6 Luna 三分之一
2026.07.30 · 周四研究论文
TraceCoder:让 LLM 代码生成可解释可审计
2026.07.29 · 周三行业动态
OpenAI 报告:智能体 AI 正在重塑科学计算
2026.07.28 · 周二行业动态
AI 编码 Agent 30 天产出 212 个 PR,但验证环节全面失守
2026.07.27 · 周一工具
BBC Micro AI Agent 实验:让大模型编写 8 位机 BASIC 绘图
2026.07.25 · 周六模型发布
Kimi K3 将登陆 Together AI,编码能力接近旗舰、价格仅约三分之一
2026.07.24 · 周五开源
开源多 Agent 编码工具 AutoDev Studio:号称对冷启动 Claude Code 节省 7%–75% 成本
2026.07.23 · 周四产品功能
Qwen 3.8 Max 预览版接受第三方测试:Three.js 场景生成速度领先
2026.07.23 · 周四模型发布
月之暗面发布 Kimi K3:2.8 万亿参数开源模型登顶前端代码榜
2026.07.22 · 周三研究论文
无需重训练即可跨方言泛化:模式约束解码在 MLIR 上的基准与评估
2026.07.21 · 周二研究论文
DeepSWE:面向 AI 编程智能体的新一代基准
2026.07.20 · 周一行业动态
AI 擅长什么?编码强、写作弱背后的真正原因
2026.07.19 · 周日工具
Wolfram 推出 LLM 基准测试项目,以 Wolfram Language 代码生成为核心任务
2026.07.17 · 周五模型发布
月之暗面介绍 Kimi K3:融合 3D 推理、编码与视觉能力
2026.07.09 · 周四工具
Google 更新 Android Bench:新增 8 款主流编程大模型
2026.07.06 · 周一研究论文
研究称 LLM 代码生成存在「语义塌缩」问题
2026.07.05 · 周日工具
Speck v1.0 发布:用规格文件驱动 AI 智能体管理
2026.07.03 · 周五研究论文
社区推出 Surface Evolver Bench:用物理仿真代码生成能力测试 LLM
2026.07.01 · 周三行业动态
社区讨论:生产环境中 AI 编码的可靠性,框架比模型更重要
2026.06.28 · 周日行业动态
