Новости про Perplexity
63 материалов с упоминанием Perplexity: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Perplexity.
-
Proxima: Бесплатный доступ к Frontier-моделям через браузерные сессии
Разработчики представили Proxima — локальный шлюз, позволяющий использовать ChatGPT, Claude и Gemini в IDE бесплатно, эмулируя вход в аккаунты через браузер.
-
TinyCeNN-LM: Как заменить Attention без потери качества
Исследователи представили TinyCeNN-LM — метод постобученной конверсии LLM, заменяющий механизм внимания на клеточно-рекуррентные слои (CeNN) с жестким контролем качества.
-
GGUF, GPTQ, AWQ, EXL2: Разбор форматов LLM в 2026 году
В 2026 году экосистема локальных LLM окончательно структурировалась. Разбираем, чем отличаются контейнеры и методы квантования, почему AutoGPTQ устарел, а AWQ выиграла Best Paper Award.
-
HP ZBook Ultra G3a: 192 ГБ ОЗУ и 300B LLM локально на AMD Ryzen AI Max+ PRO
HP представила мобильную рабочую станцию ZBook Ultra G3a на базе AMD Ryzen AI Max+ PRO. Ноутбук способен запускать локальные LLM до 300 млрд параметров благодаря 192 ГБ унифицированной памяти и интеграции с Perplexity.
-
FLoKD: Экономия 65% трафика при обучении LLM в федеративных сетях
Исследователи представили FLoKD — метод адаптивного дистилляции знаний для LoRA-моделирования в беспроводных сетях, снижающий объем передаваемых данных без потери точности.
-
Проект Lilly: люди читают личные переписки в ChatGPT
OpenAI нанимает сотни подрядчиков для ручной проверки чатов, включая диалоги с персональными данными. Ставка $50/час не гарантирует анонимность.
-
Perplexity Portable Computer для Windows: локальный AI-агент на NVIDIA RTX
Perplexity выпустила локальную версию агента Portable Computer для Windows. Решение работает на видеокартах NVIDIA RTX с 24 ГБ VRAM, обеспечивая приватность данных и интеграцию с офисными приложениями без расхода облачны
-
OpenAI: GPT-6 Astra стала основой для Perplexity
Perplexity AI объявила о переходе на GPT-6 Astra для своих систем, что подчеркивает доверие к новой модели OpenAI в задачах поиска и генерации ответов.
-
Perplexity раскрыла архитектуру pplx-embed: Ivy, Tulip и ROSE
Инженеры Perplexity опубликовали детали инфраструктуры GPU-инференса для эмбеддингов. Система на базе Rust и Python достигает высокой пропускной способности за счет переиспользования ядер LLM и кастомных оптимизаций.
-
NVIDIA IFA 2026: Локальный AI, RTX Spark и ускорение в 1.9x
NVIDIA анонсировала новые инструменты для локального запуска AI-агентов, ПК RTX Spark и оптимизации llama.cpp/vLLM, повышающие скорость инференса до 1.9x.
-
Qwen3-4B в 1.64 бита: цена сжатия и реальная скорость
Исследователи провели пост-тренировочную тернаризацию модели Qwen3-4B, сократив размер до 3.96 GiB. Однако урезанная точность и падение производительности на 4.6x ставят под вопрос практическую пользу такого сжатия.
-
Perplexity открыла Lily: Rust-движок для Qwen3.6 на Apple Silicon
Perplexity выпустила специализированный inference-движок Lily для модели Qwen3.6-35B-A3B. Без PyTorch и MLX, на чистом Rust и Metal, он обходит стандартные решения на Mac до 1.42x быстрее.
-
Perplexity Hybrid Compute: Облако + Mac для приватных данных
Perplexity запустила гибридные вычисления на Mac: облачные агенты передают чувствительные задачи на локальную модель через PII-фильтр.
-
Perplexity AI для Windows: тест агента на 5 сложных задачах
Perplexity расширила функцию Personal Computer на Windows 10/11. Редактор ZDNet протестировал агента на реальных рабочих задачах: от анализа PDF до управления Outlook.
-
Portable Computer: локальный AI-каркас для NVIDIA DGX Spark
Платформа Portable Computer позволяет развернуть на DGX Spark полноценную среду с оркестратором, двумя дообученными моделями и изолированной песочницей.
-
Сжатие LLM: скрытые риски, невидимые для метрик
Исследование arXiv (2026) показывает, что стандартные метрики скрывают асимметричные потери: модели теряют узкоспециализированные знания, но сохраняют ложную уверенность, а скрытая предвзятость меняется в разные стороны
-
Рейтинг приватности AI 2026: кто собирает данные, а кто уважает границы
Исследование Incogni оценило 13 популярных AI-платформ по уровню угрозы конфиденциальности. Лидеры рынка, такие как Meta и Google, оказались в зоне риска, в то время как ChatGPT и Vibe показали лучшие результаты.
-
MoE-маршрутизаторы не кэшируются: провал обучения локальности для Qwen3
Исследование с предварительной регистрацией доказало: обучение маршрутизаторов MoE для повышения локальности данных снижает промахи кэша, но критически ухудшает качество модели (perplexity).
-
Perplexity AI: 60% рост выручки в Индии после окончания бесплатной акции
Несмотря на спад загрузок, Perplexity зафиксировала значительный рост доходов в Индии после завершения партнерства с Airtel, что подтверждает эффективность стратегии монетизации.
-
EntropyMoE: Мозаика без токенизатора на базе энтропии байтов
Исследователи представили EntropyMoE — архитектуру MoE для LLM без токенизатора, где маршрутизация экспертов управляется энтропией динамических байтовых патчей, что снижает perplexity без потери качества.
-
Firebird запустила крупнейшую AI-фабрику в СНГ: 70 000 GPU Blackwell и Rubin
В Армении открылась крупнейшая в СНГ AI-фабрика на базе NVIDIA DSX. К 2027 году мощность достигнет 300 МВт, а парк GPU превысит 70 000 единиц.
-
Shopify: AI-поиск не убивает Google, а приносит x3 трафика
Shopify отчиталась о росте выручки на 36% до $3,6 млрд, приписывая успех AI-поиску. В отличие от медиа, где AI снижает клики, в e-commerce он ускоряет конверсию и продвигает «длинный хвост» товаров.
-
Как распознать AI-текст без моделей: математика и метрики
Исследование показывает, что детекция LLM-генерации возможна на основе статистических аномалий, а не только нейросетей. Разбор ключевых метрик: perplexity, burstiness и синтаксической сложности.
-
Федеративное обучение: почему fine-tuning обманывает при оценке моделей
Исследование показывает, что стандартная проверка через дообучение (fine-tuning) на GLUE ненадежна для сравнения федеративных моделей. Прогнозирование следующего токена (next-token prediction) точнее отражает качество об
-
ClatScope: 70+ инструментов OSINT теперь доступны на Android
Разработчик Joshua Clatney выпустил мобильную версию ClatScope Mini, а полная версия Info Tool объединяет более 70 функций для глубокой разведки, включая интеграцию с AI и базами утечек.
-
AI-взлом через код: как LLM игнорируют скрытые инструкции от коллег
Исследование показало, что большинство современных LLM (5 из 8) без вопросов выполняют скрытые команды, внедренные в код другими моделями, игнорируя безопасность ради «технических» указаний.
-
Polar: AI-браузер от экс-сотрудника Perplexity для аналитиков
Команда Polar, основанная бывшим инженером Perplexity, привлекла $5.7 млн на запуск AI-браузера, специализированного для сложных задач knowledge work.
-
cMoLLM: Горизонтальное масштабирование MoE через динамические свертки
Исследователи представили cMoLLM — архитектуру, заменяющую стандартные FFN-эксперты на динамические свертки, что устраняет проблемы гомогенизации маршрутизации и коллапса градиентов в больших языковых моделях.
-
Perplexity выпустила pplx: CLI-инструмент для агентов с жестким JSON-контрактом
Perplexity представила официальный клиент pplx для терминала, превращая Search API в надежный источник данных для AI-агентов. Инструмент работает без режима чата, возвращая строго структурированный JSON.
-
Perplexity Personal Computer: Тест агента на Mac
Журналист ZDNET протестировал новую функцию Perplexity для macOS, способную самостоятельно выполнять сложные многошаговые задачи, от создания приложений до работы с облачными сервисами.