ARIS-in-AI-Offer · MIT · 28 topics

AI 知识库

把 ARIS 的 AI 面试与研究知识点整合成可搜索、可分组、可中英切换的阅读台。适合从一个主题顺着学,也适合面试前快速横跳。

源仓库
28
主题
7
方向
2
语言
来源
ARIS-in-AI-Offer · Ruofeng Yang (杨若峰) · MIT
28 个匹配主题
基础
基础
P2 · 相对稳定reviewed 2026-06-29

Attention 面试 Cheat Sheet

从 scaled dot-product 到 MHA、mask、复杂度、数值稳定性和 PyTorch 实现。

attentionMHAcross attention
打开阅读
基础
基础
P2 · 建议关注

归一化 / 残差 / 初始化

BatchNorm、LayerNorm、RMSNorm、Pre/Post-LN、DeepNorm、初始化与残差缩放。

LayerNormRMSNormPre-LN
打开阅读
基础
基础
P2 · 建议关注

优化器 & LR Schedule

SGD、Momentum、Adam、AdamW、Muon/Lion/Shampoo,以及 warmup、cosine、WSD。

AdamWwarmupcosine
打开阅读
基础
进阶
P2 · 建议关注

KL Divergence in RLHF

KL 估计、k1/k2/k3、placement bias,以及 RLHF 中 KL 惩罚的实现细节。

KLRLHFk1
打开阅读
后训练
进阶
P2 · 建议关注

RLHF / DPO / GRPO / PPO

从偏好数据到 policy optimization,比较 DPO、PPO、GRPO 的目标与工程取舍。

RLHFDPOGRPO
打开阅读
后训练
前沿
P0 · 建议关注reviewed 2026-06-29

Reasoning Models

o1/R1、test-time compute、PRM、verifiable reward 与推理模型训练范式。

reasoningo1R1
打开阅读
后训练
前沿
P2 · 建议关注

LLM On-Policy Distillation

MiniLLM、GKD、Qwen3、Tinker 等 on-policy distillation 机制和训练信号。

OPDdistillationMiniLLM
打开阅读
后训练
系统
P2 · 建议关注

LoRA / PEFT

LoRA、QLoRA、DoRA、rsLoRA、PiSSA、AdaLoRA、Adapter 与 Prompt tuning。

LoRAQLoRADoRA
打开阅读
架构系统
系统
P2 · 建议关注

MoE (Mixture-of-Experts)

Router、expert load balance、capacity、DeepSeek-V3、Mixtral、Llama 4 等架构要点。

MoErouterexpert
打开阅读
架构系统
系统
P0 · 建议关注reviewed 2026-06-29

Long Context: RoPE / YaRN / NTK / MLA

位置编码外推、RoPE scaling、YaRN、NTK、MLA、sliding window 与长上下文成本。

RoPEYaRNNTK
打开阅读
架构系统
前沿
P0 · 建议关注reviewed 2026-06-29

线性 / 稀疏注意力

线性注意力、SSM/Mamba、Mamba-2/SSD、DeltaNet、NSA、MoBA 与混合架构。

linear attentionMambaSSD
打开阅读
架构系统
系统
P1 · 优先更新

KV Cache + Speculative Decoding

KV cache 显存、GQA/MLA、Medusa、EAGLE、speculative decoding 与推理吞吐。

KV cachespeculative decodingMedusa
打开阅读
架构系统
系统
P1 · 建议关注reviewed 2026-06-29

Quantization

GPTQ、AWQ、FP8、NVFP4、SmoothQuant 与部署中的精度/速度权衡。

quantizationGPTQAWQ
打开阅读
架构系统
系统
P2 · 建议关注

Distributed Training

DDP、FSDP2、ZeRO、TP、PP、SP、CP、EP 等大模型训练并行策略。

DDPFSDPZeRO
打开阅读
生成理论
进阶
P2 · 建议关注

Flow Matching Quick Reference

Conditional Flow Matching、Rectified Flow、VP/VE、训练目标与采样 ODE。

flow matchingrectified flowODE
打开阅读
生成理论
基础
P2 · 建议关注

Diffusion Foundations

DDPM、score matching、DDIM、EDM、CFG、consistency models 与从零代码。

DDPMscoreDDIM
打开阅读
生成理论
进阶
P2 · 建议关注

VAE / VQ-VAE / VQ-GAN / FSQ

连续/离散 latent、codebook、commitment loss、GAN 感知损失与 tokenizer 设计。

VAEVQ-VAEVQ-GAN
打开阅读
生成系统
系统
P1 · 建议关注reviewed 2026-06-29

Image Generation Systems

LDM、Stable Diffusion、SDXL、SD3、FLUX、ControlNet 与图像生成系统工程。

LDMStable DiffusionSDXL
打开阅读
生成系统
前沿
P1 · 建议关注reviewed 2026-06-29

Video Generation

Sora、Hunyuan-Video、Kling、Wan、Movie Gen 与视频生成训练/推理机制。

SoraHunyuanKling
打开阅读
生成系统
前沿
P2 · 建议关注

3D Generation

NeRF、Instant-NGP、3DGS、SDS、DreamFusion、Trellis 与 3D 生成面试题。

NeRF3DGSSDS
打开阅读
生成系统
前沿
P1 · 建议关注

Diffusion Post-Training

DDPO、DPOK、DRaFT、AlignProp、Diffusion-DPO、Flow-GRPO 等生成后训练。

DDPODPOKDRaFT
打开阅读
生成系统
前沿
P2 · 建议关注

Diffusion / Flow Distillation

Consistency Models、iCT、sCM、CTM、LCM、DMD/DMD2、ADD/LADD 与加速采样。

consistencyLCMDMD
打开阅读
多模态
系统
P1 · 建议关注reviewed 2026-06-29

VLM / Multimodal

CLIP、LLaVA、Qwen-VL、DeepSeek-VL、视觉编码器、投影器和多模态训练。

VLMCLIPLLaVA
打开阅读
智能体
系统
P2 · 建议关注

Agent Foundations

ReAct、tool use、MCP、A2A、SWE-bench、GAIA、OSWorld 与 agent 架构基础。

agentReActMCP
打开阅读
智能体
前沿
P0 · 建议关注reviewed 2026-06-29

Agentic RL

AgentTuning、ToolRL、RAGEN、WebRL、SWE-RL、tool-use GRPO 与轨迹奖励。

Agentic RLToolRLRAGEN
打开阅读
智能体
前沿
P2 · 建议关注

Multi-Agent & Long-Horizon

CAMEL、AutoGen、MetaGPT、MoA、Debate、MemGPT、LATS 与长程任务规划。

multi-agentAutoGenMetaGPT
打开阅读
智能体
前沿
P2 · 建议关注

Self-Evolving Agents

Ctx2Skill、Native Evolution、A2RD、Voyager、Reflexion、STaR 等自进化机制。

self-evolvingVoyagerReflexion
打开阅读
智能体
系统
P1 · 建议关注reviewed 2026-06-29

RAG + 文本嵌入 / 检索

InfoNCE、hard negatives、BM25、HNSW、RRF、ColBERT、HyDE、GraphRAG 与 RAGAS。

RAGembeddingBM25
打开阅读
我的音乐