• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
AITopGuide
Новости нейросетей и полезная информация об ИИ
Автор

admin

admin

    Генерация изображений

    Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

    admin 31.07.2026


    Alibaba выпустила Qwen-Image-3.0 — третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий текст, сборка сложных инфографик за один проход. Бенчмарков, весов и технического отчёта компания не раскрыла.

    Содержание

    1. Промпт на 4500 токенов вместо тысячи
    2. Текст размером в десять пикселей
    3. Модель, которая подглядывает в прогноз погоды
    4. Газетные полосы, сторибоарды, карточки товаров
    5. Ни весов, ни отчёта, ни лицензии
    6. Пятое место как точка отсчёта
    7. Tencent и Thinking Machines показывают, что закрытость — выбор

    Промпт на 4500 токенов вместо тысячи

    Прежняя версия, Qwen-Image 2.0, принимала подписи максимум на тысячу токенов. Qwen-Image-3.0 увеличила лимит в 4,5 раза, и это не просто техническая деталь. С длинным промптом модель собирает композиции, которые раньше требовали склейки нескольких картинок. Витринный пример команды Qwen — сетка три на три с девятью разными иллюстрациями (диаграмма по физике, доказательство из теории групп, разбор по биологии и ещё шесть), собранная из одной инструкции на 3700 токенов. Второй пример — вложенные интерфейсы: редактор кода, внутри которого открыто окно чата, а внутри чата — мессенджер.

    Текст размером в десять пикселей

    Вторая заявленная сильная сторона — мелкая деталь. Alibaba утверждает, что модель читаемо рендерит текст высотой всего десять пикселей и воспроизводит фактуру кожи, волос и бумаги почти на уровне фотографии. В галерее релиза — разворот академической статьи с многострочными формулами, макет газетной полосы, добавление рукописных пометок на готовое изображение и реставрация повреждённой картины в традиционной технике.

    Модель, которая подглядывает в прогноз погоды

    Третий блок команда называет «мировыми знаниями»: нативный рендеринг на 12 языках и больше чем 20 шрифтов, воспроизведение интерфейсов вроде веб-страниц и трансляций, и способность подтягивать актуальные данные из сети прямо в изображение. Пример из презентации — график прогноза погоды для конкретного города на конкретную дату. Для генератора картинок это необычная претензия: модель здесь работает не только с формой, но и с содержанием, которое само по себе должно быть верным.

    Газетные полосы, сторибоарды, карточки товаров

    Alibaba целится в контент-продакшен: вёрстку новостных полос, сторибоарды для короткометражных драм, макеты интерфейсов, карточки для маркетплейсов. Ровно тот сегмент, где вопрос о раскрытии участия ИИ в производстве материала уже не абстрактный, а рабочий — редакции и агентства такие изображения публикуют массово. Обе стороны примеров команда выбирала сама, и удобство для конкретной задачи ещё предстоит проверить на чужих промптах, а не на витринных.

    Ни весов, ни отчёта, ни лицензии

    Пост о релизе не содержит таблицы с бенчмарками, числа параметров, лицензии и технического отчёта о том, как модель обучали и тестировали. Попробовать её можно только через Qwen Chat. Это разворот на 180 градусов относительно того, как серия выходила раньше. Qwen-Image 1.0 в августе 2025 года вышла сразу с открытыми весами под лицензией Apache 2.0 и техническим отчётом день в день. У Qwen-Image 2.0 был собственный технический отчёт, и там же фигурировал прежний лимит в тысячу токенов — единственная цифра из старого релиза, с которой теперь можно сравнить новую. Для генератора изображений закрытость обиднее, чем для текстовой модели: качество тут субъективно, а рендеринг текста — как раз то направление, где демо на подобранных примерах обычно выглядит сильнее, чем модель под системным тестированием.

    Пятое место как точка отсчёта

    У Alibaba есть собственный ориентир, откуда считать прогресс. В бенчмарке Qwen-Image-Bench, который команда Qwen опубликовала сама, предыдущий флагман Qwen Image 2.0 Pro занял пятое место. Первую строчку держит GPT Image 2 от OpenAI, следом идут модели Nano Banana от Google и GPT Image 1.5. Оценка построена на модели-судье, которая, по словам авторов бенчмарка, хорошо совпадает с оценками живых людей, но тест всё равно собственный, а мерили им прошлое поколение, а не 3.0.

    Пятое место — не худший старт, но и не тот, с которого закрытые бенчмарки выглядят убедительно. Заявка на скачок есть, а способа её проверить со стороны — нет.

    Tencent и Thinking Machines показывают, что закрытость — выбор

    Конкуренты в те же недели поступили иначе. Tencent выпустила HunyuanImage 3.0 с открытыми весами, а Thinking Machines Lab свою первую мультимодальную модель Inkling тоже отдала с весами в комплекте. На этом фоне решение Qwen читается не как техническое ограничение, а как коммерческий расчёт: пока конкуренты делятся моделями, Alibaba бережёт свежий релиз для собственного чат-продукта. Судить, оправдан ли скачок с тысячи до 4500 токенов и заявленная читаемость десятипиксельного текста, можно будет только по одному признаку — появятся ли веса, карточка модели и независимые тесты. До этого момента у разработчиков есть только подборка картинок, которую выбрала сама компания.



    Источник

    31.07.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Новости

    Нейросеть будет «следить» за мусорными полигонами России

    admin 31.07.2026
    31.07.2026

    РЭО анонсировал создание нейросети для мониторинга мусорных полигонов России. Система, запуск которой ожидается в 2024 году, будет выявлять различные нарушения …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    admin 30.07.2026
    30.07.2026

    Firefly Video Model теперь могут протестировать все желающие. Этот инструмент позволяет создавать 5-секундные видеоролики в 1080p на основе текстовых описаний …

    0 VKOdnoklassnikiEmail
  • Новости

    Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google

    admin 30.07.2026
    30.07.2026

    ВУЗы Казахстана в сотрудничестве с Google запускают пилотный проект по обучению искусственному интеллекту. Министр науки страны подчеркивает важность подготовки студентов …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Higgsfield AI: Революция в создании видео с искусственным интеллектом

    admin 30.07.2026
    30.07.2026

    Higgsfield AI — это инновационная платформа, которая меняет подход к созданию видео с помощью искусственного интеллекта. Запущенная в 2023 году …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    admin 29.07.2026
    29.07.2026

    Платформа Freepik первой в мире внедрила Google Veo 2 — новую модель генерации видео от Google DeepMind. Интеграция этой технологии …

    0 VKOdnoklassnikiEmail
  • Новости

    Израиль инвестирует в развитие ИИ для понимания иврита и арабского

    admin 29.07.2026
    29.07.2026

    Израиль инвестирует 30 млн шекелей в разработку искусственного интеллекта для понимания иврита и арабского языка, стремясь сократить разрыв с английским …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    admin 29.07.2026
    29.07.2026

    ???? Введение Higgsfield AI — мощная нейросеть для генерации видео с уникальными визуальными эффектами. Один из самых узнаваемых среди них …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Pika Labs представляет Pika 2.2: Новая эра в AI-видеогенерации с 10-секундными клипами

    admin 28.07.2026
    28.07.2026

    Pika Labs снова удивляет мир искусственного интеллекта: новая модель Pika 2.2 поднимает планку возможностей AI-видеогенерации, предлагая пользователям более длинные и …

    0 VKOdnoklassnikiEmail
  • Новости

    Расшифровка эмоций птиц: новый подход к пониманию вокализации кур с помощью ИИ и машинного обучения

    admin 28.07.2026
    28.07.2026

    Японские исследователи разработали инструмент на основе искусственного интеллекта, который может «переводить» эмоции кур, помогая понимать их благополучие. Новое исследование представляет …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов
  • Нейросеть будет «следить» за мусорными полигонами России
  • Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом
  • Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google
  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

    31.07.2026
  • Нейросеть будет «следить» за мусорными полигонами России

    31.07.2026
  • Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    30.07.2026
  • Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google

    30.07.2026
  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    29.07.2026

Рубрики

  • Генерация видео (94)
  • Генерация звука (14)
  • Генерация изображений (85)
  • Генерация текста (48)
  • Новости (40)
  • Обзор сервисов (36)

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но...

31.07.2026

Нейросеть будет «следить» за мусорными полигонами России

31.07.2026

Adobe запустила Firefly Video Model – генератор AI-видео...

30.07.2026

Казахстанские университеты вводят курсы по искусственному интеллекту в...

30.07.2026

Higgsfield AI: Революция в создании видео с искусственным...

30.07.2026

Обзоры

  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    29.07.2026
  • Как оплатить Higgsfield AI и какие есть тарифы: подробный гайд

    28.07.2026

Выбор редакции

  • Промт для Nano Banana: Визуализация состава продукта в стиле Солнечной системы

    06.07.2026
  • Маск запускает Grok Imagine — ИИ, способный генерировать видео

    07.07.2026
  • Anthropic открыла расширенные функции Claude для бесплатных пользователей

    30.06.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • 3

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- All Right Reserved.


Наверх
AITopGuide
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов