73 нейросетей от 39 провайдеров — от первых LLM до Claude Fable 5. Переключайся между хронологией, интерактивным графом семейств и таблицей. Обновляется автоматически при добавлении новой модели.
Флагман OpenAI от 23.04.2026. GPT-5.5 задаёт SOTA на 14 публичных бенчмарках, обходит Claude Opus 4.7 и Gemini 3.1 Pro. Та же скорость, что у GPT-5.4, но на ~40% меньше токенов на задачу. Особенно силён в агентском коде (Terminal-Bench 2.0 — 82,7%), управлении ОС (OSWorld-Verified — 78,7%), GDPval (84,9%) и FrontierMath. Цена API вдвое выше предшественника. Доступен в ChatGPT и Codex для Plus, Pro, Business, Enterprise. Лидер в Artificial Analysis Intelligence Index (60)
Флагманская модель OpenAI для генерации изображений внутри ChatGPT. Умеет искать в интернете перед созданием картинки, генерировать несколько вариантов из одного промпта и проверять результат. Разрешение до 2K, корректный рендеринг текста внутри изображений, поддержка нескольких соотношений сторон. Подходит для маркетинговых материалов, журнальных макетов и многопанельных комиксов
Самая мощная публично доступная модель Anthropic из семейства Claude 4.7. Превосходит Opus 4.6, GPT-5.4 и Gemini 3.1 Pro в ключевых бенчмарках. Специализируется на сложном кодинге, агентных задачах и долгих многошаговых сценариях. Умеет проверять собственный вывод перед отчётом, работает с памятью между сессиями и обрабатывает изображения в разрешении до 2576 пикселей. Новый уровень рассуждений xhigh даёт тонкий контроль между глубиной и скоростью
Первая закрытая модель Meta от Superintelligence Labs. Мультимодальная модель рассуждений: текст, изображения, речь. Уникальный Contemplating Mode — мульти-агентная параллельная система. Три режима: Instant, Thinking, Contemplating. Бесплатно через meta.ai.
Флагманская агентная модель для кодинга. 744B параметров MoE, 40B активных. Обучена на чипах Huawei Ascend 910B. Лидер SWE-Bench Pro (58.4%). Поддерживает 600+ итераций без деградации. MIT лицензия. Максимальный output 128K токенов.
Модель распознавания речи Microsoft. 25 языков включая русский. В 2.5 раза быстрее Azure Fast. Лучший WER на FLEURS, обгоняя Whisper, GPT-Transcribe и Gemini Flash-Lite. Аудиофайлы до 200 МБ.
Модель генерации речи Microsoft. Естественная выразительная речь с сохранением голоса. 60 секунд аудио за 1 секунду. Клонирование голоса из 10-секундного образца через Azure Personal Voice. Интеграция в Copilot для подкастов.
Семейство открытых мультимодальных моделей Google. 4 варианта от 2.3B до 31B. Текст, изображения, аудио, видео. 31B Dense — #3 в Arena AI. Apache 2.0, 140+ языков, function calling.
Модель генерации изображений Microsoft. Топ-3 на Arena.ai. До 1024x1024, промпт до 32K токенов. В 2 раза быстрее MAI-Image-1. 10-50 млрд параметров. Интеграция в Bing, PowerPoint и Copilot. Дешевле DALL-E 3.
Флагманская российская языковая модель от Сбера. Контекст 128K токенов, долговременная память, встроенный интерпретатор кода и автономный веб-поиск. Лучшее понимание русского языка среди всех моделей.
Доработанная NVIDIA версия Llama 4 Maverick от Meta — 17B активных параметров из 400B MoE. Лидер открытых моделей по качеству рассуждений, превосходит GPT-4o и Claude Sonnet на ключевых бенчмарках.
Оптимальная модель Anthropic по соотношению цены и качества из семейства Claude 4.6. Приближается к Opus по интеллекту при значительно меньшей стоимости. Отлично справляется с кодингом, анализом документов, агентными задачами и computer use. Контекст 1M токенов, до 64K токенов на выходе. Идеальна для повседневных рабочих задач, где нужен баланс между скоростью, качеством и ценой.
На этой странице собраны все опубликованные на Shtruzel модели ИИ, отсортированные по дате релиза. Каждый узел — самостоятельная нейросеть: от базовых LLM (GPT, Claude, Gemini, Llama, Mistral) до специализированных моделей для генерации изображений (Midjourney, FLUX, Stable Diffusion, DALL-E), видео (Sora, Veo, Kling, Runway) и голоса (ElevenLabs, Whisper, Suno).
Хронология — группирует модели по году и месяцу с подробным описанием. Граф — интерактивная паутина с физикой: связывает модели одного провайдера и одной категории, видно кластеры семейств и темп их обновления. Таблица — компактный список с сортировкой по имени, дате, провайдеру или категории. Данные обновляются автоматически при добавлении новой модели через админку.
Флагманская модель генерации изображений от Black Forest Labs. Разрешение до 4K, фотореалистичная точность, лучшее следование промптам. Основной конкурент Midjourney v8.
Премиум image-модель Google из линейки Gemini 3 Pro. Флагман Google на рынке генерации картинок в 2026: лучшая в индустрии точность промпта, работа со сложными сценами и текстовыми элементами, разрешение до 4K. Преемник популярной Nano Banana.
Image-модель Google из линейки Gemini 2.5 Flash — быстрая и точная генерация картинок по тексту. Известна под кодовым именем Nano Banana: задаёт новый стандарт качества в бюджетном сегменте за счёт отличного следования промпту, 2K-разрешения и редактирования на входе текст + картинка.
Флагманская языковая модель Яндекса с контекстом 128K токенов. Встроена в Алису, Яндекс Браузер и Документы. Лучшее понимание русского языка, режим рассуждений и работа с файлами.
Серия LLM от Alibaba с гибридным рассуждением. 8 моделей: 6 плотных (0.6B-32B) и 2 MoE (30B/3B, 235B/22B). 36 трлн токенов обучения, 119 языков. Думающий режим для сложных задач, быстрый для простых. Apache 2.0.
Флагманская MoE-модель Meta со 128 экспертами. 400B параметров, 17B активных. Контекст 1M токенов. Превосходит GPT-4o и Gemini 2.0 Flash. Сопоставима с DeepSeek v3 при вдвое меньшем числе активных параметров.
MoE-модель Meta с 16 экспертами. 109B параметров, 17B активных. Рекордный контекст 10 миллионов токенов. Текст, изображения, видео. 40 трлн токенов обучения, 200 языков. Llama 4 Community License.
Лидер AI-видеогенерации: до 60 секунд непрерывного видео в 4K. Reference images для консистентности персонажей, Motion Brush для контроля движения, Aleph для редактирования видео после генерации.
Генератор изображений с лучшим в индустрии рендерингом текста (90-95% точность). Style Reference для консистентного стиля, Magic Fill для редактирования. 25 бесплатных изображений в день.
Gemini 2.5 Pro — самая мощная модель Google с расширенным мышлением (thinking). Контекст 1M токенов, лидер в кодинге и рассуждениях. Выпущена в марте 2025 года.
Флагманская модель от xAI (Илон Маск). Контекст 131K токенов, режим рассуждений, интеграция с X (Twitter) для доступа к данным в реальном времени. Минимальная цензура среди фронтирных моделей.
Генератор видео на ИИ. Видео до 10 секунд в 1080p. Scene Ingredients, Pikaframes, Pikadditions, Pikaffects. Текст в видео, изображение в видео. Бесплатный тариф с 80 кредитами.
Компактная языковая модель Microsoft с 14 млрд параметров и впечатляющими возможностями. Открытый исходный код, высокие показатели в математике и рассуждениях при малом размере.
Модель генерации векторной и растровой графики, занявшая первое место в Imagen Arena по качеству рендеринга текста. Поддерживает SVG-вывод, брендинг и дизайн-системы.
Claude Sonnet 3.5 — рабочая лошадка Anthropic с контекстом 200K токенов. Лучший баланс качества и цены среди моделей Claude, лидирует на SWE-bench по написанию кода.
Семейство открытых моделей генерации изображений на MMDiT. Large (8.1B), Large Turbo (4 шага инференса) и Medium (2.5B, 9.9 ГБ VRAM). Типографика, сложные промпты. Бесплатно для коммерческого использования до $1M выручки.
Высокоскоростная языковая модель от 01.AI с оптимизированным инференсом и контекстным окном 16K токенов. Одна из самых быстрых и дешёвых моделей в классе.
Playground v3 — модель генерации изображений с акцентом на дизайн и графику. Превосходит SDXL в типографике и точном следовании инструкциям, поддерживает редактирование изображений прямо в браузере.
Генеративная модель изображений от Яндекса. Умеет рисовать читаемый текст на картинках, понимает промпты на русском. Каскадная диффузия и гибридная архитектура для точного следования описанию.
Minimax Video (Video-01) — мультимодальная модель для генерации видео со звуком от китайской компании MiniMax. Поддерживает синхронизацию аудио и видео, реалистичные диалоги и озвучку персонажей.
Гибридная языковая модель AI21 Labs на архитектуре SSM+Transformer (Mamba). 94 млрд параметров, контекстное окно 256K токенов при низком потреблении памяти.
Hailuo AI от MiniMax — китайская модель для генерации видео высокого качества по тексту и изображениям. Поддерживает бесплатный уровень доступа и предлагает реалистичную физику движений.
Флагманская модель генерации изображений от Google DeepMind, доступная через Vertex AI и Google AI Studio. Обеспечивает фотореалистичное качество и точное следование текстовым описаниям.
Крупнейшая открытая языковая модель от Meta с 405 миллиардами параметров. Сопоставима с GPT-4 по возможностям при полной открытости весов.
GPT-4o Mini — лёгкая и сверхдешёвая версия GPT-4o от OpenAI. При стоимости $0,15 за 1M входных токенов обеспечивает качество уровня GPT-4 для большинства практических задач.
Открытая модель-кодировщик от DeepSeek с архитектурой MoE на 236 млрд параметров (активны 21B), поддержка 128K контекста и 338 языков программирования.
Luma Dream Machine от Luma AI — модель для генерации реалистичного видео по тексту и изображениям. Запущена в июне 2024 года, отличается высоким качеством движений камеры и фотореализмом.
Специализированная модель Mistral AI для написания и анализа кода. Поддерживает более 80 языков программирования, обученная на 80+ млрд токенов кода.
GPT-4o — мультимодальная флагманская модель OpenAI с нативной обработкой текста, изображений и аудио. Выпущена в мае 2024 года, стала стандартом качества для сложных задач.
Мощная открытая модель-смесь экспертов (MoE) от Mistral AI с 141 млрд параметров. Флагман открытого источника с контекстом 64K и сильными показателями в коде и рассуждениях.
Флагманская языковая модель Cohere с контекстом 128K, оптимизированная для RAG и корпоративного поиска. Поддержка инструментов, многошаговые агенты, 10 языков.
Сбалансированная языковая модель Mistral AI среднего уровня с поддержкой кода и мультимодальных задач. Оптимальное соотношение качества и стоимости для бизнес-задач.
Лёгкая и быстрая языковая модель Mistral AI для бюджетных задач. Высокая скорость генерации при минимальных затратах, поддержка кода и русского языка.
Передовая система распознавания речи с открытым исходным кодом от OpenAI. Поддерживает 99 языков включая русский, обеспечивает высокую точность транскрипции и перевода.