<div>
<p>Компания NVIDIA представила полноценный открытый фреймворк для защиты «агентных» AI-систем — от обучения до реального запуска. Такой подход позволяет не просто фильтровать нежелательный контент, но и постоянно отслеживать соответствие моделей внутренним политикам и внешним требованиям.</p>
<h2>Что за рецепт?</h2>
<p>Речь идёт о наборе инструментов и методик, объединённых в «рецепт безопасности». Он включает:</p>
<ul>
<li>Наборы открытых данных для тренировки на безопасность;</li>
<li>Метрики и тесты для оценки соответствия бизнес-политикам;</li>
<li>NeMo Guardrails — рантайм-проверки на этапе инференса.</li>
</ul>
<h2>Зачем это нужно?</h2>
<p>Представьте себе ситуацию: AI-агент проходит наполненное контентом интервью, а потом внезапно начинает «заигрывать» с небезопасными темами или даже пытается обойти фильтры. Страшно? Именно таких рисков помогает избежать рецепт NVIDIA.</p>
<h2>Что даёт фреймворк?</h2>
<p>После применения пост-тренировочного «рецепта» безопасность контента выросла с 88% до 94%, а устойчивость к враждебным запросам — с 56% до 63% без потери качества ответов. Так что модели становятся одновременно безопаснее и надёжнее.</p>
<h2>Как начать?</h2>
<p>Всё доступно в виде Jupyter‑блокнота или прямо в облаке через NVIDIA Brev — никаких закрытых решений, только открытый код и механизмы прозрачности.</p>
<h2>Кому пригодится?</h2>
<p>От стартапов до крупных предприятий — всем, кто развивает автономных AI‑ассистентов, чат‑ботов и интеллектуальные агенты. А вы готовы повысить безопасность своих систем?</p>
</div>
AI-новости29 июля 2025 г., 16:05 МСК🤖 Auto
NVIDIA представила открытый рецепт безопасности AI-агентов
<p> NVIDIA открыла исходный код «рецепта безопасности» для агентных AI-систем — комплексного инструмента, позволяющего тестировать и защищать модели на всех этапах жизненного цикла.</p>