Новый формат тестирования: от текста к 3D
Платформа Vercel запустила интерактивный бенчмарк, оценивающий способность AI-моделей генерировать не просто код, а полноценные интерактивные веб-страницы. В фокусе внимания — «Premium Real Estate 3D Website»: архитектурный проект с прокруткой, пространственной типографикой и реальными 3D-моделями. Это сложный сценарий, требующий от модели понимания геометрии, анимации и UX-паттернов.
Участники сравнения
В тесте участвуют три флагманские модели, каждая из которых получила одинаковый промпт на создание иммерсивного опыта:
- Kimi K3 (от Moonshot AI)
- GPT-5.6 Sol (от OpenAI)
- Opus 5 (от Anthropic)
Ключевые метрики и результаты
Хотя точные баллы в открытом доступе представлены в виде интерактивных превью, визуальный анализ показывает, что Kimi K3 демонстрирует наиболее стабильный результат в генерации сложных 3D-сцен. Модель успешно справляется с:
- Рендерингом пространственной типографики
- Интеграцией реальных 3D-активов
- Соблюдением производственных ограничений (производительность, загрузка)
| Модель | Специализация в тесте | Статус |
|---|---|---|
| Kimi K3 | Генерация 3D-сцен и пространственного дизайна | Лидер по визуальной целостности |
| GPT-5.6 Sol | Логика и структура кода | Активное участие |
| Opus 5 | Сложные архитектурные решения | Активное участие |
Почему это важно для разработчиков
Результаты Kimi K3 сигнализируют о сдвиге в возможностях AI-агентов: они больше не просто пишут HTML/CSS, а понимают контекст 3D-пространства. Для веб-разработчиков это означает возможность автоматизации создания сложных лендингов и презентаций, которые ранее требовали работы команды дизайнеров и 3D-моделлеров. Тестирование доступно на leonsbenchmark.vercel.app.
Источник: Vercel ↗
