Новости про GitHub
992 материалов с упоминанием GitHub: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице GitHub.
-
Microsoft выпустила Flint: язык визуализации для AI-агентов
Microsoft представила Flint — промежуточный язык, позволяющий AI-агентам автоматически генерировать сложные графики из семантических описаний, поддерживая 5+ бэкендов.
-
GTA 2 под RTX Remix: Path Tracing, 60 FPS и динамическое освещение
Моддер gebdag превратил 27-летнюю GTA 2 в современный проект с трассировкой лучей, используя кастомный Direct3D 9-мост для обхода ограничений legacy-API.
-
SigNoz: OpenTelemetry-платформа с ClickHouse и AI-наблюдаемостью
SigNoz предлагает единое решение для APM, логов и трассировок на базе OpenTelemetry и ClickHouse, обещая снижение затрат на инфраструктуру до 50% по сравнению с Elastic.
-
Univer Workspace: Open-source платформа для совместной работы людей и AI-агентов
Проект Univer Workspace объединяет редактирование документов, таблиц и слайдов с возможностью безопасного взаимодействия AI-агентов через изолированные ветки (Worktree) и человеческий контроль.
-
ComfyMax MusicLab: Локальный AI-анализ музыки без облаков
Новый инструмент ComfyMax MusicLab позволяет локально разделять дорожки, транскрибировать текст и создавать сцены для музыки, используя Demucs и Whisper без отправки данных в облако.
-
WanPE: 397B-модель для режиссерского контроля видео от Wan Team
Команда Wan Team представила улучшайзер промптов WanPE на 397B параметров, превращающий короткие запросы в детальные покадровые сценарии с контролем камеры, света и звука.
-
MoneyPrinterTurbo: Авто-генерация видео для TikTok и Shorts за 3 шага
Китайский разработчик выпустил бесплатный open-source инструмент MoneyPrinterTurbo, автоматизирующий создание коротких видео для TikTok, Reels и YouTube Shorts от сценария до монтажа.
-
Pipecat: Python-фреймворк для мультимодальных AI-агентов в реальном времени
Новый open-source инструмент позволяет разработчикам создавать голосовых и мультимодальных AI-агентов с задержкой, близкой к нулю, поддерживая передачу управления между моделями.
-
Open Manager для ComfyUI: Полный контроль над рабочим пространством
WASasquatch выпустил Open Manager — альтернативу ComfyUI-Manager, объединяющую установку нод, загрузку моделей, мониторинг ресурсов и файловый менеджер в едином интерфейсе без добавления узлов в граф.
-
Local Knowledge Graph: LLM-графы на вашем ПК с точностью 82.5%
Проект mpe-lkg превращает пошаговые рассуждения локальных LLM в используемый RDF-граф. Qwen3:4b обходит Llama3.2:3b в арифметике, работая полностью офлайн.
-
Microsoft выпустила Skill-recorder: ИИ-агенты, обучающиеся на ваших действиях
Microsoft открыла исходный код инструмента Skill-recorder, позволяющего записывать действия пользователя в интерфейсе и воспроизводить их ИИ-агентами без программирования.
-
AnyPS5: Прямой порт PS5 игр на ПК без эмуляции
Новый open-source проект AnyPS5 предлагает уникальный подход к запуску игр PlayStation 5 на ПК, минуя этап эмуляции процессора.
-
RLHF для роботов: почему пост-обучение — главный барьер для массового внедрения
Исследователи из Stanford и Physical Intelligence описывают, почему робототехника застряла в эпохе «GPT-2» и что нужно, чтобы превратить RL из ремесла в стандартизированный процесс.
-
Google Labs открыла код Stitch Skills: 14+ навыков для связки дизайна и кода
Google Labs выпустила библиотеку Stitch Skills с открытым исходным кодом, позволяющую AI-агентам (Codex, Cursor, Claude) напрямую работать с дизайном в Stitch. Это закрывает разрыв между визуальным прототипированием и ге
-
Microsoft объединила Copilot: новые вкладки, агенты и модель оплаты
Microsoft представила единое приложение Copilot для бизнеса и потребителей, добавив вкладки Code и Autopilot. Внедрена новая модель ценообразования с раздельной оплатой за чат и использование агентов.
-
PanoSeg3R: Прорыв в 3D-сегментации с приростом mIoU до 16.02
Исследователи представили PanoSeg3R — feed-forward модель для семантической сегментации панорам, которая достигает state-of-the-art результатов без оптимизации на сцене.
-
META: LLM-агент с эпизодической памятью для трейдинга
Исследователи представили META — первую многоагентную систему с RAG-подобной памятью, которая учитывает прошлые рыночные режимы для повышения точности краткосрочных прогнозов.
-
AI-судьи: как когнитивное разнообразие снижает взлом на 10%
Исследование Anya Habana показывает, что гибридные жюри из LLM с разными стратегиями мышления (причинно-следственное vs статистическое) устойчивее к манипуляциям, чем ансамбли разных провайдеров.
-
SimpleX Chat: Мессенджер без ID пользователей, который делает Signal устаревшим
SimpleX Chat представил архитектуру, полностью исключающую идентификаторы пользователей, что обеспечивает 100% защиту метаданных и делает невозможным отслеживание контактов даже для серверов.
-
Dashi PPT Skill: AI-генерация PPTX с редактором и 12 темами
Новый open-source инструмент chuspeeism/dashi-ppt-skill позволяет AI-агентам создавать редактируемые презентации PPTX прямо в браузере, предлагая 1020+ версий и встроенный UI-консоль.
-
Filestash: Универсальный файловый менеджер с поддержкой 20+ протоколов и AI
Filestash эволюционировал из простого аналога Dropbox в платформу с плагинной архитектурой, поддерживающую S3, WebDAV, IPFS и AI-функции для поиска и OCR.
-
Samsung Labs выпустила Samsone: 3 модели аудио-LLM до 356M параметров
Лаборатория Samsung Labs представила семейство открытых малых языковых моделей (SALMs) Samsone для анализа звука на устройствах. Модели превосходят аналоги по эффективности и доступны для Android.
-
ESP-Drone: Открытая платформа LiteWing на ESP32 для разработки дронов
Проект ESP-Drone эволюционировал в платформу LiteWing, позволяющую создавать стабильные дроны на базе ESP32 с управлением по Wi-Fi и удержанием позиции.
-
DeepEP V2.5: ускорение MoE в 1.3x и экономия SM в 4 раза
DeepSeek выпустила DeepEP V2.5 — библиотеку коммуникаций для MoE-моделей. Новый бэкенд NCCL Gin и JIT-компиляция обеспечивают пропускную способность, близкую к пределам железа, при минимальном использовании SM.
-
Ovis-Omni-Embedding-3B: Новый лидер кросс-модального поиска от Alibaba
Команда Alibaba ATH-MaaS представила универсальную модель эмбеддингов Ovis-Omni-Embedding-3B, способную обрабатывать текст, изображения, видео, аудио и документы в едином пространстве. Модель показала рекордные результат
- zvec-grep (zg) от Alibaba Qwen
-
Как обучить свой Jev за $17: гайд от Together AI
Together AI представила методологию создания классификаторов уровня Jev на базе Qwen3.5 4B. Обучение на 38k примеров стоит всего $17, а запуск занимает 25 минут.
-
ffmpeg-skill: 42 инструментов для AI-монтажа видео без облаков
Новый open-source пакет kajisho5/ffmpeg-skill превращает локальный FFmpeg в управляемый ИИ-агентом движок. 42 скрипта, строгая типизация и отсутствие API-ключей.
-
ComfyUI-InpaintCanvas: Полный редактор слоев и инпейнтинга внутри ComfyUI
Новый нод ComfyUI-InpaintCanvas заменяет внешние графические редакторы, предоставляя инструменты выбора, слои, фильтры и инпейнтинг в одном интерфейсе.
-
Oh-my-claudecode: оркестрация мультиагентов в Claude Code
Пользователь Yeachan Heo выпустил инструмент Oh-my-claudecode (OMC), позволяющий автоматизировать сложные задачи в Claude Code через мультиагентную оркестрацию, включая режимы Autopilot и Team.