9) Lecture 8 - Monte Carlo Methods Reinforcement Learning Phase Reasoning LLMs from Scratch5просмотров4 месяца назад
8) Lecture 7 - Dynamic Programming Reinforcement Learning Phase Reasoning LLMs from Scratch5просмотров4 месяца назад
7) Lecture 6 - Value Functions Reinforcement Learning Reasoning LLMs from Scratch3просмотра4 месяца назад
28) How DeepSeek Rewrote Quantization Part 2 Accumulation Precision Online Quantization5просмотров4 месяца назад
27) How DeepSeek Rewrote Quantization Part 1 Mixed Precision Fine-grained quantization3просмотра4 месяца назад
20) Mixture of Experts Balancing Techniques Auxiliary Loss Load Balancing Capacity Factor5просмотров4 месяца назад