OpenAI запускает ChatGPT Images 2.0, генерирующий 8 связных изображений за сеанс
Компания OpenAI только что выпустила генератор изображений на базе искусственного интеллекта, созданный на основе своей новой модели GPT Image2, — ChatGPT Images 2.0. Главной особенностью этой версии является наделение ИИ более развитыми «способностями к логическому мышлению», что позволяет ему вести себя скорее как логически мыслящий творец при решении сложных визуальных задач.

Благодаря системе логического планирования генерация изображений перестает быть «игрой в угадывание»
В отличие от прежнего подхода, при котором изображения генерировались напрямую, в Images 2.0 добавлена система глубокого логического планирования. Когда функция логического мышления активирована, ИИ сначала ищет информацию в Интернете и анализирует файлы, загруженные пользователем. Благодаря предварительному анализу структуры изображения и планированию компоновки конечный результат лучше соответствует логической интуиции, а не просто представляет собой набор отдельных элементов. Эта расширенная функция в настоящее время доступна подписчикам ChatGPT Plus, Pro, Business и Enterprise.

Прорыв в области когерентности: генерация до 8 изображений одновременно для комиксов и дизайна
В области генерации нескольких изображений новая версия знаменует собой важную веху. Теперь Images 2.0 может создавать до 8 согласованных изображений по одному запросу. Особенно впечатляет то, что система строго поддерживает согласованность внешнего вида персонажей, деталей объектов и общего визуального стиля при переходах между различными сценами. Эта возможность значительно снижает барьер для создания длинных комиксов, иллюстраций для серий в социальных сетях или полных схем дизайна интерьера.
Улучшение качества и многоязычная настройка
С технической точки зрения новая версия повышает максимальное разрешение до 2K и предлагает соотношения сторон от 3:1 до 1:3, что делает её идеальной для кадров из фильмов, пиксельной графики и других специфических стилей. Чтобы удовлетворить потребности глобальной аудитории, команда также доработала точность генерации текста на китайском, японском, корейском, хинди и бенгальском языках, устранив типичные проблемы, такие как ошибки кодировки текста и неверные интерпретации, которые встречались в ранних изображениях, сгенерированных ИИ.
Это обновление знаменует переход в области рисования с помощью ИИ от простого «генерирования пикселей» к «пониманию и творчеству», предлагая как профессиональным дизайнерам, так и обычным пользователям более эффективные инструменты для работы с изображениями.
Связанная статья
ByteDance’s Seed запускает глобальную кампанию по набору сотрудников в кампусах, предлагая виртуальные акции для привлечения лучших специалистов по крупным языковым моделям
В условиях конкурентной борьбы крупных языковых моделей привлечение высококвалифицированных специалистов остается самым важным стратегическим активом.1 апреля ByteDance объявил о запуске глобальной программы набора на кампусы Seed, являющейся частью
Suno добавляет водяные знаки на песни в ходе судебных разбирательств
Suno, платформа, позволяющая пользователям создавать музыку с помощью искусственного интеллекта, представила новые функции для маркировки треков, созданных на платформе, ограничения на скачивание и обновления стандартов сообщества для борьбы с несанк
Маск признал, что утечка кода Grok привела к раскрытию пользовательских данных, и пообещал стереть всю историческую информацию.
Илон Маск напрямую отреагировал на скандал с конфиденциальностью вокруг Grok Build, начав с простого «Да», чтобы подтвердить достоверность инцидента. Он пообещал, что все данные пользователей, ранее загруженные в SpaceXAI, будут безвозвратно удалены,
Рекомендации по связанным специальным темам
Комментарии (0)
Компания OpenAI только что выпустила генератор изображений на базе искусственного интеллекта, созданный на основе своей новой модели GPT Image2, — ChatGPT Images 2.0. Главной особенностью этой версии является наделение ИИ более развитыми «способностями к логическому мышлению», что позволяет ему вести себя скорее как логически мыслящий творец при решении сложных визуальных задач.

Благодаря системе логического планирования генерация изображений перестает быть «игрой в угадывание»
В отличие от прежнего подхода, при котором изображения генерировались напрямую, в Images 2.0 добавлена система глубокого логического планирования. Когда функция логического мышления активирована, ИИ сначала ищет информацию в Интернете и анализирует файлы, загруженные пользователем. Благодаря предварительному анализу структуры изображения и планированию компоновки конечный результат лучше соответствует логической интуиции, а не просто представляет собой набор отдельных элементов. Эта расширенная функция в настоящее время доступна подписчикам ChatGPT Plus, Pro, Business и Enterprise.

Прорыв в области когерентности: генерация до 8 изображений одновременно для комиксов и дизайна
В области генерации нескольких изображений новая версия знаменует собой важную веху. Теперь Images 2.0 может создавать до 8 согласованных изображений по одному запросу. Особенно впечатляет то, что система строго поддерживает согласованность внешнего вида персонажей, деталей объектов и общего визуального стиля при переходах между различными сценами. Эта возможность значительно снижает барьер для создания длинных комиксов, иллюстраций для серий в социальных сетях или полных схем дизайна интерьера.
Улучшение качества и многоязычная настройка
С технической точки зрения новая версия повышает максимальное разрешение до 2K и предлагает соотношения сторон от 3:1 до 1:3, что делает её идеальной для кадров из фильмов, пиксельной графики и других специфических стилей. Чтобы удовлетворить потребности глобальной аудитории, команда также доработала точность генерации текста на китайском, японском, корейском, хинди и бенгальском языках, устранив типичные проблемы, такие как ошибки кодировки текста и неверные интерпретации, которые встречались в ранних изображениях, сгенерированных ИИ.
Это обновление знаменует переход в области рисования с помощью ИИ от простого «генерирования пикселей» к «пониманию и творчеству», предлагая как профессиональным дизайнерам, так и обычным пользователям более эффективные инструменты для работы с изображениями.
ByteDance’s Seed запускает глобальную кампанию по набору сотрудников в кампусах, предлагая виртуальные акции для привлечения лучших специалистов по крупным языковым моделям
В условиях конкурентной борьбы крупных языковых моделей привлечение высококвалифицированных специалистов остается самым важным стратегическим активом.1 апреля ByteDance объявил о запуске глобальной программы набора на кампусы Seed, являющейся частью
Suno добавляет водяные знаки на песни в ходе судебных разбирательств
Suno, платформа, позволяющая пользователям создавать музыку с помощью искусственного интеллекта, представила новые функции для маркировки треков, созданных на платформе, ограничения на скачивание и обновления стандартов сообщества для борьбы с несанк
Маск признал, что утечка кода Grok привела к раскрытию пользовательских данных, и пообещал стереть всю историческую информацию.
Илон Маск напрямую отреагировал на скандал с конфиденциальностью вокруг Grok Build, начав с простого «Да», чтобы подтвердить достоверность инцидента. Он пообещал, что все данные пользователей, ранее загруженные в SpaceXAI, будут безвозвратно удалены,





Дом






