#генерация изображений

Публикаций: 10

Qwen-Image-3.0 рисует инфографику и 10-пиксельный текст за один проход

Alibaba выпустила Qwen-Image-3.0 — генератор изображений, принимающий промпты до 4500 токенов и рендерящий читаемый текст размером от 10 пикселей. Нативные 12 языков и сложные макеты за один вызов — и честный вопрос к практической ценности растрового результата.

Google Search рисует картинки, когда не находит нужного в интернете

Google встраивает генерацию изображений прямо в поисковую выдачу: если подходящей картинки в открытом вебе нет, AI Overviews нарисует её сам на основе текста запроса. Функция строится на новой модели Nano Banana 2 Lite и выходит для всех в ближайшие недели.

Google открыл API для image→video: 4 секунды и $0.034 за картинку

Google выпустил Nano Banana 2 Lite для быстрой генерации изображений и Gemini Omni Flash для видео через API — впервые. Обе модели можно чейнить: текст → картинка → анимация за один пайплайн.

Самый быстрый и дешёвый image-генератор Gemini теперь в API

Google добавил в линейку Gemini новую image-модель — Gemini 3.1 Flash Lite Image. Позиционирование прямолинейное: самая быстрая и дешёвая image-модель в семействе, заточенная под высокую скорость и масштаб.

Качество данных важнее масштаба: Microsoft доказала это на практике

Microsoft Research выпустила Lens — модель генерации изображений на 3,8 млрд параметров, которая конкурирует с гигантами индустрии. Секрет не в размере, а в 800 миллионах детальных подписей, сгенерированных GPT-4.1.

Ideogram 4.0: открытая модель с 2K и лучшим текстом на изображениях

Ideogram выпустила версию 4.0 своей text-to-image модели как open-weight — с нативным разрешением 2K, управлением bounding box и заметно улучшенным рендерингом текста прямо на картинке. В открытом сегменте она сейчас лучшая.

MAI-Image-2.5 от Microsoft сравнялся с Google в гонке генерации изображений

Microsoft выпустила MAI-Image-2.5 — модель для генерации изображений по тексту, которая заняла третье место в публичном рейтинге Arena, встав вровень с Google Nano Banana 2. OpenAI Image-2 пока впереди, но отрыв сокращается.

Яндекс научил Алису AI правильно писать по-русски прямо на картинках

Яндекс обновил Alice AI ART: нейросеть теперь в три раза чаще генерирует изображения с корректным русским текстом — читаемые буквы, без кириллических каракулей. Параллельно на треть выросла доля картинок без визуальных искажений.

Почему ИИ не умеет шутить в картинках — и как это обойти

Редактор с контент-планом на 10–20 материалов в день выстроил полный пайплайн генерации иллюстраций через LLM + графическую модель — и всё равно упёрся в стену. Оказалось, автоматизировать можно почти всё, кроме одного.

ChatGPT рисует: артефакты, аниме и предел генеративного ИИ

ChatGPT умеет генерировать изображения прямо в чате — без отдельных инструментов, без синтаксиса промптов. Советские плакаты, аниме-портреты, арт для инди-игр — модель понимает контекст целиком, но шесть пальцев и нечитаемые надписи пока остаются визитной карточкой.

← Все статьи