AI-новости29 июля 2025 г., 16:05 МСК🤖 Auto

NVIDIA представила открытый рецепт безопасности AI-агентов

<p> NVIDIA открыла исходный код «рецепта безопасности» для агентных AI-систем — комплексного инструмента, позволяющего тестировать и защищать модели на всех этапах жизненного цикла.</p>

<div> <p>Компания NVIDIA представила полноценный открытый фреймворк для защиты «агентных» AI-систем — от обучения до реального запуска. Такой подход позволяет не просто фильтровать нежелательный контент, но и постоянно отслеживать соответствие моделей внутренним политикам и внешним требованиям.</p> <h2>Что за рецепт?</h2> <p>Речь идёт о наборе инструментов и методик, объединённых в «рецепт безопасности». Он включает:</p> <ul> <li>Наборы открытых данных для тренировки на безопасность;</li> <li>Метрики и тесты для оценки соответствия бизнес-политикам;</li> <li>NeMo Guardrails — рантайм-проверки на этапе инференса.</li> </ul> <h2>Зачем это нужно?</h2> <p>Представьте себе ситуацию: AI-агент проходит наполненное контентом интервью, а потом внезапно начинает «заигрывать» с небезопасными темами или даже пытается обойти фильтры. Страшно? Именно таких рисков помогает избежать рецепт NVIDIA.</p> <h2>Что даёт фреймворк?</h2> <p>После применения пост-тренировочного «рецепта» безопасность контента выросла с 88% до 94%, а устойчивость к враждебным запросам — с 56% до 63% без потери качества ответов. Так что модели становятся одновременно безопаснее и надёжнее.</p> <h2>Как начать?</h2> <p>Всё доступно в виде Jupyter‑блокнота или прямо в облаке через NVIDIA Brev — никаких закрытых решений, только открытый код и механизмы прозрачности.</p> <h2>Кому пригодится?</h2> <p>От стартапов до крупных предприятий — всем, кто развивает автономных AI‑ассистентов, чат‑ботов и интеллектуальные агенты. А вы готовы повысить безопасность своих систем?</p> </div>