ChatGPT родился как текстовое поле: мы вводили вопрос и получали письменный ответ. С тех пор он включает в себя изображения, графику, приложения и другие формы контента, но теперь OpenAI хочет сделать еще один шаг вперед. GPT-6 начинает распространяться на все планы ChatGPT в сопровождении интеллектуального пользовательского интерфейса, новой возможности, которая позволяет модели решать не только, что ответить, но и как лучше всего представить этот ответ, используя от обычного текста до карт, диаграмм и интерактивных инструментов, созданных непосредственно в разговоре.
GPT-6 не является чем-то новым для пользователей ChatGPT. В сентябре OpenAI представила первые модели этого поколения, начиная с GPT-6 Astra и впоследствии расширяя семейство за счет Sun and Moon, но текущее внедрение выводит эту технологию в обычный чат всех планов. Plus, Pro, Business и Enterprise используют GPT-6 Sun, в то время как учетные записи Free и Go получают GPT-6 Moon. Внедрение платных планов началось вчера и с сегодняшнего дня, 8 октября, распространяется на бесплатные, хотя это не означает, что все пользователи получают одну и ту же модель. Опция Reasoning Pro продолжает использовать GPT-6 Astra и на данный момент не включает интеллектуальный пользовательский интерфейс.
Большая заметная новинка — это именно Intelligent UI. OpenAI обучил GPT-6 комбинировать текст, графические элементы, кнопки, формы, интерактивную графику и другие компоненты в зависимости от того, что мы пытаемся сделать. Сравнение может быть автоматически организовано в столбцы, сложное объяснение может быть преобразовано в управляемую диаграмму, а планирование поездки может отображать различные остановки прямо на карте. Когда ни один из этих вариантов не приносит пользы, модель также может решить, что традиционный текстовый ответ по-прежнему является наиболее подходящим решением.
Идея идет еще дальше, потому что ChatGPT может создавать небольшие инструменты для решения конкретной задачи в ходе самого разговора. OpenAI демонстрирует такие примеры, как калькулятор, чтобы проверить, как могут развиваться наши сбережения, инструмент для разделения учетной записи между несколькими людьми или даже небольшие интерактивные игры. Речь идет не только о вставке ранее разработанного приложения, но и о создании интерфейса, адаптированного к только что сделанному запросу, его использовании и продолжении работы с ним, не покидая чат.
Чтобы достичь этого, OpenAI создала библиотеку собственных компонентов, которые могут передаваться постепенно, и компилятор, который обрабатывает интерфейс во время его генерации GPT-6. Модель решает, как организовать контент, визуальные элементы и взаимодействие, в то время как эта композиция появляется на экране, не дожидаясь завершения всего ответа. Этот последний момент особенно важен: интеллектуальный пользовательский интерфейс заключается не просто в том, чтобы ChatGPT создавал веб-страницу или добавлял визуальные элементы, а в том, чтобы позволить самой модели создавать интерфейс, соответствующий задаче, с использованием компонентов, встроенных в продукт.
GPT-6 также меняет способ получения информации пользователем. ChatGPT может начать отвечать, продолжая рассуждать или используя инструменты, добавляя новые результаты по мере их получения, вместо того, чтобы ждать завершения всего процесса перед отображением первого слова. OpenAI гарантирует, что на запросы, требующие поиска информации в Интернете, GPT-6 Instant начинает отвечать в среднем на 44% раньше, чем GPT-5.6 Instant. Эта цифра не означает, что новая модель работает на 44% быстрее в целом, но, в частности, сокращает время ожидания, пока она не начнет предлагать ответ на запросы такого типа.
Изменение может показаться в основном визуальным, но оно указывает на нечто гораздо более интересное. До сих пор, о чем бы мы ни просили, разговор в значительной степени навязывал формат ответа. GPT-6 начинает позволять ChatGPT также адаптировать свой интерфейс к стоящей перед ним проблеме, чтобы естественный язык продолжал функционировать в качестве точки входа, не заставляя нас всегда получать результат одним и тем же способом. Если эта модель будет развиваться так, как задумано OpenAI, возможно, будущее программного обеспечения будет заключаться не только в том, чтобы научиться использовать новые приложения, но и в описании того, что мы хотим делать, и позволить самому приложению временно создать необходимый нам интерфейс.
