# New York University
米国の研究大学(NYU)。LLM 学習のストラグラーを What-if 分析で解明した論文(OSDI '25)で、[[Jinkun Lin]]・Zhanghan Wang・[[Aurojit Panda]]・[[Jinyang Li]] が所属。[[ByteDance]] Seed との産学共同研究。(Source: [[@2025__OSDI__Understanding Stragglers in Large Model Training Using What-if Analysis]])
[[LLMTime]]([[@2023__NeurIPS__Large Language Models Are Zero-Shot Time Series Forecasters]])では [[Andrew Gordon Wilson]](NYU Courant Institute & Center for Data Science)・[[Nate Gruver]]・[[Shikai Qiu]] が所属。GPT-3・LLaMA-2 のゼロショット時系列予測を実現した。(Source: [[@2023__NeurIPS__Large Language Models Are Zero-Shot Time Series Forecasters]])
チェスを制御可能なテストベッドとして事前学習からRL事後学習までのスケーリング則を調べた論文([[@2026__arXiv__Understanding Reasoning from Pretraining to Post-Training]])では、[[Jingyan Shen]]・[[Ang Li]]・[[Salman Rahman]]・[[Matus Telgarsky]]・[[Pavel Izmailov]] が所属(一部は [[Modal Labs]]・[[University of California, Los Angeles]] と兼任)。事前学習・SFT・検証可能報酬RLの3段パイプラインをチェス領域に移植し、事前学習損失・トークン数からRL報酬曲線を予測する結合スケーリング則を導出した。(Source: [[@2026__arXiv__Understanding Reasoning from Pretraining to Post-Training]])
## 関連
- ソース: [[@2025__OSDI__Understanding Stragglers in Large Model Training Using What-if Analysis]] / [[@2026__arXiv__Understanding Reasoning from Pretraining to Post-Training]]
- エンティティ: [[Jinkun Lin]] / [[Aurojit Panda]] / [[Jinyang Li]] / [[ByteDance]] / [[Jingyan Shen]] / [[Ang Li]] / [[Salman Rahman]] / [[Matus Telgarsky]] / [[Pavel Izmailov]]
## 出典
- [[@2025__OSDI__Understanding Stragglers in Large Model Training Using What-if Analysis]](著者陣の所属)
- [[@2026__arXiv__Understanding Reasoning from Pretraining to Post-Training]](著者陣の所属)