OpenAI запускает ChatGPT Images 2.0, генерирующий 8 связных изображений за сеанс
Компания OpenAI только что выпустила генератор изображений на базе искусственного интеллекта, созданный на основе своей новой модели GPT Image2, — ChatGPT Images 2.0. Главной особенностью этой версии является наделение ИИ более развитыми «способностями к логическому мышлению», что позволяет ему вести себя скорее как логически мыслящий творец при решении сложных визуальных задач.

Благодаря системе логического планирования генерация изображений перестает быть «игрой в угадывание»
В отличие от прежнего подхода, при котором изображения генерировались напрямую, в Images 2.0 добавлена система глубокого логического планирования. Когда функция логического мышления активирована, ИИ сначала ищет информацию в Интернете и анализирует файлы, загруженные пользователем. Благодаря предварительному анализу структуры изображения и планированию компоновки конечный результат лучше соответствует логической интуиции, а не просто представляет собой набор отдельных элементов. Эта расширенная функция в настоящее время доступна подписчикам ChatGPT Plus, Pro, Business и Enterprise.

Прорыв в области когерентности: генерация до 8 изображений одновременно для комиксов и дизайна
В области генерации нескольких изображений новая версия знаменует собой важную веху. Теперь Images 2.0 может создавать до 8 согласованных изображений по одному запросу. Особенно впечатляет то, что система строго поддерживает согласованность внешнего вида персонажей, деталей объектов и общего визуального стиля при переходах между различными сценами. Эта возможность значительно снижает барьер для создания длинных комиксов, иллюстраций для серий в социальных сетях или полных схем дизайна интерьера.
Улучшение качества и многоязычная настройка
С технической точки зрения новая версия повышает максимальное разрешение до 2K и предлагает соотношения сторон от 3:1 до 1:3, что делает её идеальной для кадров из фильмов, пиксельной графики и других специфических стилей. Чтобы удовлетворить потребности глобальной аудитории, команда также доработала точность генерации текста на китайском, японском, корейском, хинди и бенгальском языках, устранив типичные проблемы, такие как ошибки кодировки текста и неверные интерпретации, которые встречались в ранних изображениях, сгенерированных ИИ.
Это обновление знаменует переход в области рисования с помощью ИИ от простого «генерирования пикселей» к «пониманию и творчеству», предлагая как профессиональным дизайнерам, так и обычным пользователям более эффективные инструменты для работы с изображениями.
Связанная статья
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Соблюдение требований к автономным транспортным средствам в Калифорнии: новая эра штрафов, геозоны и 1 млн миль
Компания Guident эксплуатирует шаттл AuveTech в Южной Флориде, обслуживая маршрут протяженностью четыре мили в Вест-Палм-Бич и маршрут протяженностью одну милю в Бока-Ратоне с использованием своей тех
Рекомендации по связанным специальным темам
Комментарии (0)
Компания OpenAI только что выпустила генератор изображений на базе искусственного интеллекта, созданный на основе своей новой модели GPT Image2, — ChatGPT Images 2.0. Главной особенностью этой версии является наделение ИИ более развитыми «способностями к логическому мышлению», что позволяет ему вести себя скорее как логически мыслящий творец при решении сложных визуальных задач.

Благодаря системе логического планирования генерация изображений перестает быть «игрой в угадывание»
В отличие от прежнего подхода, при котором изображения генерировались напрямую, в Images 2.0 добавлена система глубокого логического планирования. Когда функция логического мышления активирована, ИИ сначала ищет информацию в Интернете и анализирует файлы, загруженные пользователем. Благодаря предварительному анализу структуры изображения и планированию компоновки конечный результат лучше соответствует логической интуиции, а не просто представляет собой набор отдельных элементов. Эта расширенная функция в настоящее время доступна подписчикам ChatGPT Plus, Pro, Business и Enterprise.

Прорыв в области когерентности: генерация до 8 изображений одновременно для комиксов и дизайна
В области генерации нескольких изображений новая версия знаменует собой важную веху. Теперь Images 2.0 может создавать до 8 согласованных изображений по одному запросу. Особенно впечатляет то, что система строго поддерживает согласованность внешнего вида персонажей, деталей объектов и общего визуального стиля при переходах между различными сценами. Эта возможность значительно снижает барьер для создания длинных комиксов, иллюстраций для серий в социальных сетях или полных схем дизайна интерьера.
Улучшение качества и многоязычная настройка
С технической точки зрения новая версия повышает максимальное разрешение до 2K и предлагает соотношения сторон от 3:1 до 1:3, что делает её идеальной для кадров из фильмов, пиксельной графики и других специфических стилей. Чтобы удовлетворить потребности глобальной аудитории, команда также доработала точность генерации текста на китайском, японском, корейском, хинди и бенгальском языках, устранив типичные проблемы, такие как ошибки кодировки текста и неверные интерпретации, которые встречались в ранних изображениях, сгенерированных ИИ.
Это обновление знаменует переход в области рисования с помощью ИИ от простого «генерирования пикселей» к «пониманию и творчеству», предлагая как профессиональным дизайнерам, так и обычным пользователям более эффективные инструменты для работы с изображениями.
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства





Дом






