论文
研究图谱
按研究分类浏览论文目录,或快速查看近期收录条目。
169论文
10分类
407资源链接
2026.09最新月份
浏览
研究分类
7 篇论文
注意力机制
围绕 Transformer 内部机制、注意力变体、KV 缓存行为和跨层信息流的研究。
2026.06
注意力架构
24 篇论文
大语言模型
基础模型报告、推理方法、长上下文语言建模、代码与推理系统研究。
2026.08
基础模型、推理、检测
20 篇论文
多模态大模型
连接视觉、视频、动作与语言推理的多模态理解和生成研究。
2026.08
多模态推理、视觉-语言-动作、视觉语言
2 篇论文
嵌入模型
面向检索、语义匹配、表示学习和嵌入模型训练的研究。
2025.06
直接收录
4 篇论文
监督微调
监督微调方法、数据配方、token 加权和推理泛化研究。
2026.05
监督微调方法
9 篇论文
训练
可复用训练配方、监督微调、数据选择、蒸馏和优化实践。
2026.08
优化、数据准备、蒸馏
58 篇论文
强化学习
奖励建模、RLHF 类优化、推理强化学习、智能体强化学习和 VLA 策略学习。
2026.09
OPD、多模态强化学习、奖励建模、推理强化学习、智能体强化学习、策略优化、视觉-语言-动作强化学习、视频生成强化学习
40 篇论文
智能体应用
智能体系统、工具调用、记忆、AI 研究工作流和可复用技能生态。
2026.08
AI 研究、工具调用、数据智能体、智能体开发、智能体技能、智能体评测、网络智能体、计算机使用、记忆
2 篇论文
视觉
对现代多模态系统有参考价值的计算机视觉方法。
2026.05
目标检测、语义对应
3 篇论文
自动提示
提示词优化、评测器提示、提示集成和测试时提示学习。
2025.12
提示优化、评测器提示
最新索引
近期论文
2026.09
SafeEvolve: Harness-Policy Co-Evolution from Agent Experience for Safety Alignment
强化学习
2026.08
BDH-CQ: In-Context Learning with Recurrent Latent Reasoning
大语言模型
2026.08
On the Design of Qwen3.8-Next Architecture: Evaluation, Efficiency, and Training Stability
大语言模型
2026.08
LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers
大语言模型
2026.08
AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses
大语言模型
2026.08
Intern-S2-Preview: Scientific Agentic Foundation Model
多模态大模型
2026.08
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving
多模态大模型
2026.08
BigBang: Pursuing Open-Ended Intelligence through Self-Evolving Synthesis of Verifiable Frontier Tasks
训练