NVIDIA представила Nemotron-4 340B — семейство моделей для подготовки синтетических данных, на которых можно обучать другие языковые системы. В него вошли базовая версия, модель для выполнения инструкций и отдельная модель вознаграждения. Последняя оценивала ответы по полезности, корректности, связности, сложности и объему.
Компания описала последовательность, в которой одна модель создает примеры, а другая помогает отбирать подходящие материалы для обучения. Для адаптации и выполнения предложили NVIDIA NeMo и TensorRT-LLM. Веса стали доступны через NGC и Hugging Face по открытой лицензии NVIDIA, предусматривающей коммерческое использование. Релиз был ориентирован на разработчиков, которым трудно собрать достаточно разнообразных размеченных данных для собственных прикладных моделей.