• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
AITopGuide
Новости нейросетей и полезная информация об ИИ
Категория:

Генерация изображений

    Генерация изображений

    Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

    admin 31.07.2026


    Alibaba выпустила Qwen-Image-3.0 — третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий текст, сборка сложных инфографик за один проход. Бенчмарков, весов и технического отчёта компания не раскрыла.

    Содержание

    1. Промпт на 4500 токенов вместо тысячи
    2. Текст размером в десять пикселей
    3. Модель, которая подглядывает в прогноз погоды
    4. Газетные полосы, сторибоарды, карточки товаров
    5. Ни весов, ни отчёта, ни лицензии
    6. Пятое место как точка отсчёта
    7. Tencent и Thinking Machines показывают, что закрытость — выбор

    Промпт на 4500 токенов вместо тысячи

    Прежняя версия, Qwen-Image 2.0, принимала подписи максимум на тысячу токенов. Qwen-Image-3.0 увеличила лимит в 4,5 раза, и это не просто техническая деталь. С длинным промптом модель собирает композиции, которые раньше требовали склейки нескольких картинок. Витринный пример команды Qwen — сетка три на три с девятью разными иллюстрациями (диаграмма по физике, доказательство из теории групп, разбор по биологии и ещё шесть), собранная из одной инструкции на 3700 токенов. Второй пример — вложенные интерфейсы: редактор кода, внутри которого открыто окно чата, а внутри чата — мессенджер.

    Текст размером в десять пикселей

    Вторая заявленная сильная сторона — мелкая деталь. Alibaba утверждает, что модель читаемо рендерит текст высотой всего десять пикселей и воспроизводит фактуру кожи, волос и бумаги почти на уровне фотографии. В галерее релиза — разворот академической статьи с многострочными формулами, макет газетной полосы, добавление рукописных пометок на готовое изображение и реставрация повреждённой картины в традиционной технике.

    Модель, которая подглядывает в прогноз погоды

    Третий блок команда называет «мировыми знаниями»: нативный рендеринг на 12 языках и больше чем 20 шрифтов, воспроизведение интерфейсов вроде веб-страниц и трансляций, и способность подтягивать актуальные данные из сети прямо в изображение. Пример из презентации — график прогноза погоды для конкретного города на конкретную дату. Для генератора картинок это необычная претензия: модель здесь работает не только с формой, но и с содержанием, которое само по себе должно быть верным.

    Газетные полосы, сторибоарды, карточки товаров

    Alibaba целится в контент-продакшен: вёрстку новостных полос, сторибоарды для короткометражных драм, макеты интерфейсов, карточки для маркетплейсов. Ровно тот сегмент, где вопрос о раскрытии участия ИИ в производстве материала уже не абстрактный, а рабочий — редакции и агентства такие изображения публикуют массово. Обе стороны примеров команда выбирала сама, и удобство для конкретной задачи ещё предстоит проверить на чужих промптах, а не на витринных.

    Ни весов, ни отчёта, ни лицензии

    Пост о релизе не содержит таблицы с бенчмарками, числа параметров, лицензии и технического отчёта о том, как модель обучали и тестировали. Попробовать её можно только через Qwen Chat. Это разворот на 180 градусов относительно того, как серия выходила раньше. Qwen-Image 1.0 в августе 2025 года вышла сразу с открытыми весами под лицензией Apache 2.0 и техническим отчётом день в день. У Qwen-Image 2.0 был собственный технический отчёт, и там же фигурировал прежний лимит в тысячу токенов — единственная цифра из старого релиза, с которой теперь можно сравнить новую. Для генератора изображений закрытость обиднее, чем для текстовой модели: качество тут субъективно, а рендеринг текста — как раз то направление, где демо на подобранных примерах обычно выглядит сильнее, чем модель под системным тестированием.

    Пятое место как точка отсчёта

    У Alibaba есть собственный ориентир, откуда считать прогресс. В бенчмарке Qwen-Image-Bench, который команда Qwen опубликовала сама, предыдущий флагман Qwen Image 2.0 Pro занял пятое место. Первую строчку держит GPT Image 2 от OpenAI, следом идут модели Nano Banana от Google и GPT Image 1.5. Оценка построена на модели-судье, которая, по словам авторов бенчмарка, хорошо совпадает с оценками живых людей, но тест всё равно собственный, а мерили им прошлое поколение, а не 3.0.

    Пятое место — не худший старт, но и не тот, с которого закрытые бенчмарки выглядят убедительно. Заявка на скачок есть, а способа её проверить со стороны — нет.

    Tencent и Thinking Machines показывают, что закрытость — выбор

    Конкуренты в те же недели поступили иначе. Tencent выпустила HunyuanImage 3.0 с открытыми весами, а Thinking Machines Lab свою первую мультимодальную модель Inkling тоже отдала с весами в комплекте. На этом фоне решение Qwen читается не как техническое ограничение, а как коммерческий расчёт: пока конкуренты делятся моделями, Alibaba бережёт свежий релиз для собственного чат-продукта. Судить, оправдан ли скачок с тысячи до 4500 токенов и заявленная читаемость десятипиксельного текста, можно будет только по одному признаку — появятся ли веса, карточка модели и независимые тесты. До этого момента у разработчиков есть только подборка картинок, которую выбрала сама компания.



    Источник

    31.07.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Midjourney запустила V8 Alpha с ускоренной генерацией и улучшенным пониманием запросов

    admin 27.07.2026
    27.07.2026

    Midjourney открыла доступ к альфа-версии V8 — новой модели генерации изображений, которая работает в несколько раз быстрее и точнее понимает …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Luma Labs представила модель Uni-1 которая думает и рисует одновременно

    admin 26.07.2026
    26.07.2026

    Luma Labs представила Uni-1 — первую генеративную модель, которая объединяет мышление и создание изображений в одном процессе. Система не просто …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Midjourney V8.1 ускорилась и вернула стиль

    admin 25.07.2026
    25.07.2026

    Midjourney выпустила альфа-версию V8.1, в которой разработчики сделали ставку на баланс: вернули фирменный визуальный стиль, ускорили генерацию и сразу добавили …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    ImagineArt показала модель 2.0

    admin 24.07.2026
    24.07.2026

    ImagineArt представила модель ImagineArt 2.0 и делает ставку на то, что в генерации изображений пользователям важен уже не только визуальный …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    OpenAI выпустила GPT Image 2 и ChatGPT Images 2.0

    admin 23.07.2026
    23.07.2026

    OpenAI представила GPT Image 2 для API и одновременно обновила генерацию изображений в ChatGPT до версии Images 2.0. Запуск получился …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Krea AI представила Krea 2 — собственную модель для генерации изображений

    admin 22.07.2026
    22.07.2026

    Krea AI 12 мая 2026 года анонсировала Krea 2 — новую модель для генерации изображений. В ветке компания подаёт её …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Krea открыла API для Krea 2 с переносом стиля и мудбордами

    admin 21.07.2026
    21.07.2026

    Krea открыла API для Krea 2 — своей первой базовой модели генерации изображений, обученной с нуля. Анонс опубликован 27 мая …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Ideogram выпустила Ideogram 4.0 с открытыми весами и управлением макетом через JSON

    admin 20.07.2026
    20.07.2026

    Ideogram представила версию 4.0 — новую text-to-image модель с открытыми весами для генерации изображений, дизайна и типографики. Компания называет её …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Comfy MCP: ComfyUI подключает ИИ-агентов к своим пайплайнам генерации

    admin 19.07.2026
    19.07.2026

    Команда ComfyUI открыла публичную бету Comfy MCP — коннектор, через который ИИ-агенты вроде Claude, Codex, Cursor и Hermes управляют пайплайнами …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов
  • Нейросеть будет «следить» за мусорными полигонами России
  • Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом
  • Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google
  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

    31.07.2026
  • Нейросеть будет «следить» за мусорными полигонами России

    31.07.2026
  • Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    30.07.2026
  • Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google

    30.07.2026
  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    29.07.2026

Рубрики

  • Генерация видео (94)
  • Генерация звука (14)
  • Генерация изображений (85)
  • Генерация текста (48)
  • Новости (40)
  • Обзор сервисов (36)

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но...

31.07.2026

Нейросеть будет «следить» за мусорными полигонами России

31.07.2026

Adobe запустила Firefly Video Model – генератор AI-видео...

30.07.2026

Казахстанские университеты вводят курсы по искусственному интеллекту в...

30.07.2026

Higgsfield AI: Революция в создании видео с искусственным...

30.07.2026

Обзоры

  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    29.07.2026
  • Как оплатить Higgsfield AI и какие есть тарифы: подробный гайд

    28.07.2026

Выбор редакции

  • Hermes Agent получил Automation Blueprints: повторяющиеся задачи теперь можно запускать через диалог

    13.07.2026
  • Ideogram выпустила Ideogram 4.0 с открытыми весами и управлением макетом через JSON

    20.07.2026
  • OpenAI выпустила расширение ChatGPT для Excel и Google Таблиц

    06.07.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- All Right Reserved.


Наверх
AITopGuide
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов