Исследования5 августа 2026 г., 11:16 МСК🤖 Auto

VeriTrace: ИИ достиг 100% точности в генерации Verilog, устранив «потолок» агентов

Новая система VeriTrace от исследователей Liu и Yu решает проблему неполного пространства действий отладки, достигая идеальной функциональной корректности на бенчмарке VerilogEval-V2.

Баннер новости 5112

Проблема «стеклянного потолка» в RTL-генерации

Современные мультисистемные агенты на базе больших языковых моделей (LLM) демонстрируют выдающиеся результаты в автоматизированной генерации описания аппаратуры на языке Verilog. Однако, как отмечают авторы исследования, лучшие системы уперлись в потолок точности на уровне ~95%. Главная причина этого ограничения — неполное пространство действий (action space) при отладке.

Существующие подходы ограничивают агентов в выборе сигналов для инспекции или временных окон для запросов. Это превращает отладку в простое сопоставление шаблонов на узком, заранее определенном виде поведения схемы, а не в гипотезо-ориентированный поиск первопричины ошибок.

VeriTrace: Агентное временное исследование

Команда представила VeriTrace — систему, в которой агент-инспектор (Inspector) обладает полным контролем над пространством отладки. Ключевая инновация, названная Agentic Temporal Exploration (Агентное временное исследование), позволяет модели:

  • Независимо выбирать сигналы для анализа.
  • Устанавливать границы временных окон запросов.
  • Контролировать глубину итераций.

Такой подход имитирует процесс мышления инженеров по проверке (verification engineers): агент выдвигает гипотезы о причинах сбоев, запрашивает данные из волновой формы (waveform) для подтверждения и итеративно уточняет свое понимание системы.

Результаты: 100% Pass@1

VeriTrace стала первой системой, достигшей 100% показателя Pass@1 на бенчмарке VerilogEval-V2. Это означает, что с первой попытки система генерирует код, полностью функционально корректный для всех тестовых случаев. При использовании общего бэкбонного модели Claude Sonnet 4.0, VeriTrace превзошла сильнейший воспроизведенный базовый уровень на +5.1%.

Сравнение производительности

Метрика / Система Результат Примечание
VeriTrace (Claude Sonnet 4.0) 100% Pass@1 Идеальная функциональная корректность на VerilogEval-V2
Лучший воспроизведенный базовый уровень ~94.9% Pass@1 Ограниченное пространство действий отладки
Разрыв в точности +5.1% Преимущество VeriTrace над сильнейшим конкурентом

Значение для индустрии

Работа, принятая к публикации на ICLAD 2026 в качестве устного доклада (Long Oral), демонстрирует, что закрытие «пробела» в агентных действиях по отладке позволяет устранить последние барьеры на пути к полностью автономной разработке цифровых схем. Переход от реактивного патч-матчинга к проактивному исследованию временных диаграмм открывает путь к созданию надежных AI-инструментов для проектирования сложной электроники.

Источник: arXiv cs.AI ↗