На данный момент это самая крупная, после Groq-1, открытая LLM модель размером 340B.
По тестам сравнения как выигрывает у GPT-4-1106, так и проигрывает, но чаще составляет паритет.
Nemotron обучалась на 50+ естественных языках и 40+ языков программирования.
Длина контекста всего 4096 токенов.
Модель представлена в виде: Nemotron-4-340B-Base, Nemotron-4-340B-Instruct и Nemotron-4-340B-Reward.
Модель распространяется под лицензией NVIDIA Open Model License Agreement, разрешающая коммерческое использование.
Онлайн демо (Direct Chat): https://chat.lmsys.org/
Веса модели: https://huggingface.co/nvidia/Nemotron-4-340B-Instruct