LLM Personalization:个性化对齐的方法、评测与风险
七月 30, 2026 · 29 分钟 · 14378 字 · Mi Yan
Self-Evolving Agents:当 Agent 学会改进自己
七月 28, 2026 · 25 分钟 · 12234 字 · Mi Yan
Long-Horizon Agents: Harness, Learning, and Trust
七月 24, 2026 · 33 分钟 · 16468 字 · Mi Yan
Rubric:大语言模型评估范式的结构化转向
七月 23, 2026 · 17 分钟 · 8435 字 · Mi Yan
On-Policy Distillation: 重塑大模型后训练的新范式
七月 3, 2026 · 15 分钟 · 7479 字 · Mi Yan