MI Megoldások

Címke: QeRL

QeRL: az NVFP4-kvantált megerősítéses tanulás (RL) egyetlen H100-ra hozza a 32B LLM képzést—miközben javítja a felfedezést

Képzeld el, mit hozhatnál létre, ha egyetlen H100-as GPU-n futtathatnád a megerősítéses tanulást (RL) egy 32 milliárd paraméteres nyelvi modellen, mindezt 4-bites pontossággal és gyorsabb lépésidővel! Az NVIDIA kutatói, a MIT, a HKU és a Tsinghua egyetemek együttműködésével kifejlesztették a QeRL-t, egy olyan nyílt forráskódú keretrendszert, amely forradalmasítja az RL utótréninget.

2025.10.16. Continue