Qiyu Zhi 职启予
Home
Blog
Publications
Study
NAVIGATION
LLM
Tokenizer
Transformer
Positional Encoding
MoEs
Optimizations
Resource Counting
Pre-training
Pre-training Data Pipeline
Scaling Laws
LR and Annealing
Pre-training Implementation
Eval & Benchmarks
LLM Eval
LLM-as-Judge Eval
Agent Eval
Multimodal LLM Eval
Eval's Eval
SFT
Implementation
Case Studies
LoRA
RL
PPO
DPO
GRPO
RLVR
Reward & Verifier
Distillation
VLM
ViT
Image Encoding via CLIP
VLMs
Basic ML & Math
Basic Math
Notation
Backpropagation
Policy Gradient
Read
Curriculum Interview Questions
LLM 常见面试题
Interview Experience Blogs
Tech Blogs