Direct Preference Optimization: Your Language Model is Secretly a Reward Model Paper • 2305.18290 • Published May 29, 2023 • 72
Kev Collection Jev-like family of decision models built on top of Qwen3.5/3.8 you can train and run on your own • 6 items • Updated 4 days ago • 32
Word-level Deep Sign Language Recognition from Video: A New Large-scale Dataset and Methods Comparison Paper • 1910.11006 • Published Oct 24, 2019 • 2
view article Article Mixture of Experts (MoEs) in Transformers +5 ariG23498, pcuenq, merve, IlyasMoutawwakil, ArthurZ, sergiopaniego, Molbap • Feb 26 • 179
view article Article Mixture of Experts Explained +4 osanseviero, lewtun, philschmid, smangrul, ybelkada, pcuenq • Dec 11, 2023 • 1.19k