LLM

NVIDIA Nemotron 3 Ultra возглавляет рейтинг открытых моделей в агентном RTL-кодировании

Автор: AI-Sphere· 5 мин чтения
Источники: developer.nvidia.com
NVIDIA представила Nemotron 3 Ultra — открытую языковую модель, которая в составе агентного пайплайна ACE-RTL показывает лучшие результаты в задачах RTL-разработки (register transfer level) среди всех открытых решений. В бенчмарке CVDP (Comprehensive Verilog Design Problems) модель в комбинации с ACE-RTL агентом достигла 94,3% проходимости, обойдя GLM 5.2 (тоже 94,3%) и Kimi K2.6 (88,6%), но при этом используя в 2-3 раза меньше токенов на итерацию.

NVIDIA представила Nemotron 3 Ultra — открытую языковую модель, которая в составе агентного пайплайна ACE-RTL показывает лучшие результаты в задачах RTL-разработки (register transfer level) среди всех открытых решений. В бенчмарке CVDP (Comprehensive Verilog Design Problems) модель в комбинации с ACE-RTL агентом достигла 94,3% проходимости, обойдя GLM 5.2 (тоже 94,3%) и Kimi K2.6 (88,6%), но при этом используя в 2-3 раза меньше токенов на итерацию.

ACE-RTL: агентная архитектура для проектирования микросхем

Современное проектирование микросхем всё больше упирается в ограничение по инженерному времени. RTL-разработка и верификация требуют специализированных знаний в области аппаратного обеспечения, точных логических рассуждений и многократных итераций. Простая генерация Verilog по промпту не решает задачу — практический ассистент должен читать спецификации, понимать существующие модули, переиспользовать и модифицировать код, интерпретировать результаты симуляции, выявлять несоответствия и исправлять их.

ACE-RTL (Agentic Context Evolution for RTL) — это агентная система, которая решает именно эти задачи. Она состоит из нескольких компонентов: координатора, который управляет контекстом отладки и принимает решения о следующих действиях; рефлектора, который анализирует результаты симуляции, выявляет корневые причины сбоев и даёт рекомендации по исправлению; и непосредственно LLM, которая генерирует и модифицирует код.

Результаты тестирования

Бенчмарк CVDP оценивает LLM на реалистичных задачах RTL: генерация, модификация, отладка и верификация Verilog-кода. В отличие от предыдущих тестов, построенных на коротких изолированных примерах, CVDP включает комплексные сценарии, приближенные к реальной инженерной работе.

Без ACE-RTL агента standalone-модели показывают значительно более низкие результаты: GLM 5.2 — 44,0%, Nemotron 3 Ultra — 37,1%, Kimi K2.6 — 31,4%. С ACE-RTL пайплайном показатели взлетают: GLM 5.2 и Nemotron 3 Ultra достигают 94,3%, Kimi K2.6 — 88,6%.

Ключевое преимущество Nemotron 3 Ultra — эффективность. Модель использует в среднем 6 629 токенов на итерацию, тогда как GLM 5.2 — 9 156, а Kimi K2.6 — 22 579. Это означает не только более низкую стоимость инференса, но и меньшую задержку при работе агента. Более высокая проходимость при меньших затратах токенов делает Nemotron 3 Ultra оптимальным выбором для агентного кодирования в аппаратной разработке.

Значение для индустрии

RTL-кодирование традиционно считалось сложной задачей для LLM из-за требований к точности и строгим временным характеристикам. Ошибка в одной строчке Verilog может сделать микросхему неработоспособной. Результаты NVIDIA показывают, что открытые модели уже могут справляться с этой задачей на уровне, сопоставимом с проприетарными флагманами.

Nemotron 3 Ultra встраивается в экосистему NVIDIA и доступен для коммерческого использования. Комбинация открытой модели и агентного фреймворка позволяет инженерам по аппаратному обеспечению существенно ускорить разработку и верификацию микросхем, сокращая время вывода новых продуктов на рынок.

#nvidia#nemotron#rtl-coding#open-models#agentic-ai

Попробуйте сами

Задайте вопрос любой нейросети прямо сейчас — без VPN и иностранной карты

Начать чат