Awesome LLM Research Collections
  • Home
  • Papers
    • Overview
    • Attention
    • LLMs
    • Multimodal LLMs
    • Embeddings
    • SFT
    • Training
    • Reinforcement Learning
    • Agents Application
    • Vision
    • Auto-Prompt
  • Notes
  • Blogs
  • English
  • 中文

论文

English

研究图谱

按研究分类浏览论文目录,或快速查看近期收录条目。

169论文
10分类
407资源链接
2026.09最新月份

浏览

研究分类

7 篇论文

注意力机制

围绕 Transformer 内部机制、注意力变体、KV 缓存行为和跨层信息流的研究。

2026.06 注意力架构
24 篇论文

大语言模型

基础模型报告、推理方法、长上下文语言建模、代码与推理系统研究。

2026.08 基础模型、推理、检测
20 篇论文

多模态大模型

连接视觉、视频、动作与语言推理的多模态理解和生成研究。

2026.08 多模态推理、视觉-语言-动作、视觉语言
2 篇论文

嵌入模型

面向检索、语义匹配、表示学习和嵌入模型训练的研究。

2025.06 直接收录
4 篇论文

监督微调

监督微调方法、数据配方、token 加权和推理泛化研究。

2026.05 监督微调方法
9 篇论文

训练

可复用训练配方、监督微调、数据选择、蒸馏和优化实践。

2026.08 优化、数据准备、蒸馏
58 篇论文

强化学习

奖励建模、RLHF 类优化、推理强化学习、智能体强化学习和 VLA 策略学习。

2026.09 OPD、多模态强化学习、奖励建模、推理强化学习、智能体强化学习、策略优化、视觉-语言-动作强化学习、视频生成强化学习
40 篇论文

智能体应用

智能体系统、工具调用、记忆、AI 研究工作流和可复用技能生态。

2026.08 AI 研究、工具调用、数据智能体、智能体开发、智能体技能、智能体评测、网络智能体、计算机使用、记忆
2 篇论文

视觉

对现代多模态系统有参考价值的计算机视觉方法。

2026.05 目标检测、语义对应
3 篇论文

自动提示

提示词优化、评测器提示、提示集成和测试时提示学习。

2025.12 提示优化、评测器提示

最新索引

近期论文

2026.09 SafeEvolve: Harness-Policy Co-Evolution from Agent Experience for Safety Alignment 强化学习 2026.08 BDH-CQ: In-Context Learning with Recurrent Latent Reasoning 大语言模型 2026.08 On the Design of Qwen3.8-Next Architecture: Evaluation, Efficiency, and Training Stability 大语言模型 2026.08 LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers 大语言模型 2026.08 AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses 大语言模型 2026.08 Intern-S2-Preview: Scientific Agentic Foundation Model 多模态大模型 2026.08 Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving 多模态大模型 2026.08 BigBang: Pursuing Open-Ended Intelligence through Self-Evolving Synthesis of Verifiable Frontier Tasks 训练
  • View source
  • Report an issue