Awesome LLM Research Collections
  • Home
  • Papers
    • Overview
    • Attention
    • LLMs
    • Multimodal LLMs
    • Embeddings
    • SFT
    • Training
    • Reinforcement Learning
    • Agents Application
    • Vision
    • Auto-Prompt
  • Notes
  • Blogs
  • English
  • 中文

Papers

中文

Research atlas

Browse the paper catalog by research category or jump into the newest curated entries.

169Papers
10Categories
407Resource links
2026.09Latest month

Browse

Research Categories

7 papers

Attention

Transformer internals, attention variants, KV/cache behavior, and depth-wise information flow.

2026.06 Attention Architecture
24 papers

LLMs

Foundation model reports, inference methods, long-context language modeling, coding, and reasoning systems.

2026.08 Detection, Foundation Models, Inference
20 papers

Multimodal LLMs

Vision-language, video-language, and VLA research that connects perception with language reasoning.

2026.08 Multimodal Reasoning, VLA, Vision-Language
2 papers

Embeddings

Representation learning, retrieval, semantic matching, and embedding model research.

2025.06 Direct collection
4 papers

SFT

Supervised fine-tuning methods, data recipes, token weighting, and reasoning generalization studies.

2026.05 SFT Methods
9 papers

Training

Reusable training recipes, SFT methods, data selection, distillation, and optimization practice.

2026.08 Data Preparation, Distillation, Optimization
58 papers

Reinforcement Learning

Reward modeling, RLHF-style optimization, reasoning RL, agent RL, and VLA policy learning.

2026.09 Agentic RL, Multimodal RL, OPD, Policy Optimization, Reasoning RL, Reward Modeling, VLA RL, Video Generation RL
40 papers

Agents Application

Agent systems, tool use, memory, AI research workflows, and reusable skill ecosystems.

2026.08 AI Research, Agent Development, Agent Evaluation, Agent Skills, Computer Use, Data Agents, Memory, Tool Use, Web Agents
2 papers

Vision

Computer vision methods that are useful background for modern multimodal systems.

2026.05 Object Detection, Semantic Correspondence
3 papers

Auto-Prompt

Prompt optimization, evaluator prompting, prompt ensembles, and test-time prompt learning.

2025.12 Judge Prompting, Prompt Optimization

Fresh index

Recent Papers

2026.09 SafeEvolve: Harness-Policy Co-Evolution from Agent Experience for Safety Alignment Reinforcement Learning 2026.08 BDH-CQ: In-Context Learning with Recurrent Latent Reasoning LLMs 2026.08 On the Design of Qwen3.8-Next Architecture: Evaluation, Efficiency, and Training Stability LLMs 2026.08 LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers LLMs 2026.08 AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses LLMs 2026.08 Intern-S2-Preview: Scientific Agentic Foundation Model Multimodal LLMs 2026.08 Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving Multimodal LLMs 2026.08 BigBang: Pursuing Open-Ended Intelligence through Self-Evolving Synthesis of Verifiable Frontier Tasks Training
  • View source
  • Report an issue