2026.09.23 · 周三研究论文
←返回首页话题 · Topic
#arXiv
共 66 条相关资讯
2026.09.23 · 周三研究论文
Lean Pool:用 AI 智能体维护的形式化数学档案
2026.08.31 · 周一研究论文
知识系统中的上下文局部化与广义层级评估
2026.08.27 · 周四研究论文
研究:多智能体 LLM 竞争中自发出现谎言与操纵,无需诱导即可触发
2026.08.26 · 周三研究论文
卫星观测:AI 数据中心燃气轮机排放约为许可值 16 倍
2026.08.26 · 周三研究论文
AI 智能体自主密码分析,破解 8 项已发表构造
2026.08.25 · 周二研究论文
arXiv 论文:Transformer 强化学习智能体在隐藏规则博弈中的概念迁移研究
2026.08.25 · 周二研究论文
RIACT:用规则 + LLM 提前发现大学生学习倦怠
2026.08.25 · 周二研究论文
arXiv 论文:现有 LLM 榜单受评测配置影响巨大,同一模型分数可相差近 60 个百分点
2026.08.25 · 周二研究论文
研究称 AI 检测器难以区分轻度润色与整篇代写,学术诚信判定存漏洞
2026.08.22 · 周六研究论文
Chutes 发布一年 LLM 生产 trace,揭示 serving 负载演化与缓存/负载均衡规律
2026.08.22 · 周六研究论文
arXiv 论文 IO Factory:用十万级 AI 智能体仿真影响力行动
2026.08.21 · 周五研究论文
arXiv 预印本:近九成生物医学论文留有 AI 写作痕迹
2026.08.20 · 周四研究论文
arXiv 新论文:用多指标评分策略监测无人机螺旋桨健康
2026.08.20 · 周四研究论文
综述论文:Agentic AI 的演进、应用与未来研究方向
2026.08.19 · 周三研究论文
arXiv 新研究提出「模型催眠」:弱提示可叠加控制 AI 行为
2026.08.19 · 周三研究论文
记忆即通信:arXiv 提出智能体「记住—信号边界」框架
2026.08.19 · 周三研究论文
AI数学发现新范式:FAR流水线筛选千篇论文
2026.08.18 · 周二研究论文
研究发现多智能体大模型系统中的「思维病毒」传播风险
2026.08.18 · 周二研究论文
新基准测试暴露多模态AI推理短板:GPT-4o、Gemini 2.5 Pro不足10%
2026.08.18 · 周二研究论文
27B 模型 Faraday 论文复现任务超越 Claude Opus 4.8 与 GPT-5.5
2026.08.17 · 周一研究论文
跨学科研究构建误解生成与检测分类法,聚焦 AI 介导沟通
2026.08.17 · 周一研究论文
衡量语言模型智能体的跨任务行为一致性
2026.08.17 · 周一研究论文
arXiv 新研究:大模型高置信度错误或属「稳定误校准」而非脆弱推理
2026.08.17 · 周一行业动态
AI 涌入学术圈:高能理论投稿增三成,质量参差
2026.08.15 · 周六研究论文
立场论文:AI「推理」评测亟需统一操作定义
2026.08.13 · 周四研究论文
SAPO:分段级自动提示词优化新方法
2026.08.11 · 周二研究论文
论文曝主流大模型 API 推理痕迹可被窃取
2026.08.11 · 周二研究论文
arXiv 新论文:用博弈论优化多智能体 LLM 的路由与通信成本
2026.08.11 · 周二研究论文
TREAT 基准:大模型在等价数学变换下识别定理能力不足
2026.07.30 · 周四研究论文
TraceCoder:让 LLM 代码生成可解释可审计
2026.07.29 · 周三研究论文
MCP 应用生态首次大规模实证研究发布
2026.07.29 · 周三研究论文
PATHFinder:基于大模型的个性化产前护理对话代理
2026.07.29 · 周三研究论文
研究称大模型对齐伪装无需明确后果暗示
2026.07.27 · 周一研究论文
arXiv 论文 AI 味检测:CS 领域 65% 中标,数学仅 0.7%
2026.07.27 · 周一研究论文
FlowEvo:用工作流与技能的协同进化打造自演化智能体
2026.07.27 · 周一研究论文
arXiv 新文:面向异构边缘设备的可迁移 LLM 延迟预测框架
2026.07.27 · 周一研究论文
新研究在 Transformer 中发现「硬决策层」
2026.07.24 · 周五研究论文
ProMem:为 LLM 智能体引入主动式记忆提取
2026.07.22 · 周三研究论文
Phionyx:面向 LLM 的确定性运行时架构
2026.07.22 · 周三研究论文
SAAG:面向智能体函数调用的分层诊断框架
2026.07.22 · 周三研究论文
基于证据链评估的选择性事实核查框架
2026.07.22 · 周三研究论文
面向智能体 AI 的复合风险评估框架:CPSAINT 与 FRIESA-K
2026.07.21 · 周二研究论文
agrepl:为 AI Agent 提供确定性重放的 CLI 框架
2026.07.21 · 周二研究论文
GOI:利用大模型从文档语料自动归纳领域本体
2026.07.21 · 周二研究论文
PlanFlip 研究:多智能体大模型规划阶段存在级联注入风险
2026.07.20 · 周一研究论文
AgentAbstain 评估框架:测出 LLM 智能体何时该主动放弃行动
2026.07.20 · 周一研究论文
Cura 1T:面向医疗场景的专用大模型
2026.07.20 · 周一研究论文
GraphDx:兼顾成本与准确率的多智能体临床诊断框架
2026.07.20 · 周一研究论文
低轨建 AI 数据中心可行吗?arXiv 论文给出否定结论
2026.07.20 · 周一研究论文
研究:AI 垃圾内容致开源新贡献者合并率下降 18.18%
2026.07.08 · 周三研究论文
arXiv 论文提出 AgenticAI-Supervisor 智能体训练平台
2026.07.08 · 周三研究论文
FirstResearch:用结构化证书提升 LLM 科研问题的可审计性
2026.07.03 · 周五研究论文
GroundEval:用确定性方法替代 LLM 评判的智能体评估框架
2026.07.03 · 周五研究论文
Wiola:基于五条原创组件的小型语言模型架构
2026.07.03 · 周五研究论文
Agent4cs:面向大型层级代码库的多智能体摘要框架
2026.07.02 · 周四行业动态
arXiv 正式脱离康奈尔,以独立非营利组织身份运营
2026.07.01 · 周三研究论文
学习何时停止未必更优:推理模型早退机制的成本敏感研究
2026.07.01 · 周三研究论文
HASTE:分层技能积累让 ML 工程智能体少走弯路
2026.06.30 · 周二研究论文
arXiv 新论文:将 Agent 工作流编译进模型权重,挑战主流编排范式
2026.06.30 · 周二研究论文
AI 智能体记忆机制综述:形式、功能与动态全景
2026.06.29 · 周一研究论文
Agentic AI 全栈实践指南在 arXiv 发布
2026.06.29 · 周一研究论文
研究称主流 LLM 存在医疗分诊性别偏见
2026.06.29 · 周一研究论文
arXiv 论文提出「AI-ModelNet」:借鉴互联网思路构建模型协作网络
2026.06.29 · 周一研究论文
符号反馈驱动迭代自优化:提升 LLM 长程规划可靠性
2026.06.29 · 周一研究论文
