Skip to content
所有標籤

#synthetic-data

3 篇文章

CS224N 第 19 講:小模型如何跨過 Scaling Law 的門檻

最後一講把 Open Questions in NLP 2026 收斂成 smart scaling:以 prolonged RL、Prismatic synthetic data、RL as pretraining 與開放協作,讓小模型不只靠增加參數追求推理能力。

Stanford CS224V 第 14 講:資料受限時,語言模型還能怎麼擴展

最後一講不是完整 LLM 訓練教學,而是資料效率研究:在 compute 充足、資料固定時重看 epochs、batch、ensemble 與 self-training,再研究 synthetic continued pretraining 的可擴展條件。

CS336 Lecture 14:Filtering、Dedup 與資料混合才把 raw web 變成訓練語料

第十四講把 raw documents 經語言辨識、品質與安全 filtering、exact/near dedup、source mixing 送進訓練;每一步都會改變模型分布,而 synthetic instruction 與 agent trajectories 又把資料管線延伸到可執行環境。