Мир ИИ / Новость

Вышла GPT-6 Astra: что это значит для бизнеса в Узбекистане

3-4 сентября OpenAI выпустила GPT-6 Astra и назвала её самой умной моделью в мире. Независимые замеры показывают иное. Взгляд Tezcode: что это меняет для проектов автоматизации.

11 сентября 20267 минут чтения
Краткий ответ

OpenAI открыла GPT-6 Astra 3 сентября 2026 года в ограниченном доступе и 4 сентября для всех. Главное достижение одно: модель сама управляет компьютером и браузером и доводит многошаговую задачу до конца. В тесте OSWorld 2.0 она набрала 72,6 процента против 65,7 у предыдущей GPT-5.6 Sol и выполняет задачу почти вдвое быстрее. Цена: 10 долларов за 1 млн входных токенов и 50 за миллион выходных, то есть в 2,5 раза дороже прежнего флагмана. При этом в независимом рейтинге Artificial Analysis Astra идёт вровень с Claude Fable 5.1. То есть слова про самую умную модель верны только в таблицах самой OpenAI. Вывод для бизнеса: Astra сильна в сложной многошаговой автоматизации, но ставить её на простые задачи значит зря тратить деньги.

Что такое GPT-6 Astra и чем она отличается от прежней модели?

GPT-6 Astra — новая флагманская модель OpenAI. Ограниченный доступ открыли 3 сентября, общий 4 сентября. Предыдущим флагманом была GPT-5.6 Sol, вышедшая в июле.

Сухие цифры: модель удерживает в контексте 1 050 000 токенов, выдаёт до 128 000 токенов за ответ, знания до 30 апреля 2026 года. Обучена более чем на 100 тысячах видеокарт в центре Stargate в Техасе.

Практическая разница описывается одним словом: самостоятельность. Прежние модели отвечали на вопрос. Astra рассчитана на то, чтобы взять задачу, пройти несколько шагов и довести её до результата.

  • Контекст: 1 050 000 токенов, ответ: до 128 000 токенов
  • Цена: 10 долларов за 1 млн входных токенов, 50 за выходные
  • Прежняя GPT-5.6 Sol: 4 и 20 долларов, то есть Astra в 2,5 раза дороже
  • Сильная сторона: долгая многошаговая работа в компьютере и браузере

Главное изменение: модель сама управляет компьютером

Для нас это ключевая новость. В проектах автоматизации много времени уходит на один и тот же случай: у системы нет API, и сотрудник каждый день вручную переносит данные из одного окна в другое. До сих пор такие места автоматизировать было тяжело.

Именно здесь Astra сделала скачок. Цифры, опубликованные OpenAI: в тесте OSWorld 2.0, где модель выполняет реальную работу за компьютером, она набрала 72,6 процента против 65,7 у прежней модели. Важнее не сам балл, а время: Astra тратит на задачу около 40 минут, прежняя модель тратила 75.

В тесте на поиск элемента на экране (ScreenSpot-Pro) разрыв ещё больше: 92,7 против 76,9 процента. В работе с терминалом 57,7 балла против 37,3. То есть модель теперь способна видеть интерфейс, находить нужную кнопку и действовать последовательно.

Ещё одна хорошая новость: модель реже выдумывает. По внутреннему замеру OpenAI доля фактических ошибок упала с 12,2 до 4,2 процента.

Почему специалисты обеспокоены этой моделью?

Эту часть нельзя пропускать, потому что она влияет на решение о применении модели.

Внутри Astra использована новая техника recurrent depth. Проще говоря, часть рассуждений модели теперь проходит не словами, а во внутреннем состоянии. В результате прочитать со стороны, почему модель приняла то или иное решение, нельзя.

Это признали не критики, а сама OpenAI. В официальном документе по безопасности сказано: возможность отслеживать ход рассуждений существенно снизилась по сравнению с прежними моделями, и если модель намеренно станет работать хуже и скрывать это, поймать её мы, скорее всего, не сможем.

Второй момент: Astra впервые в истории OpenAI получила высший, критический уровень по кибербезопасности. Во время тестирования модель нашла две новые, никому не известные уязвимости. Поэтому у корпоративных клиентов эта возможность выключена по умолчанию и включается администратором вручную.

Astra лучшая во всём? Нет

Здесь нужна осторожность. OpenAI назвала её самой умной моделью в мире, но это утверждение из её собственных таблиц.

Независимый рейтинг Artificial Analysis показал иное: в последнем замере Astra и Claude Fable 5.1 от Anthropic набрали равный балл. В части тестов Astra впереди (работа с терминалом, автоматизация), в части позади (научный код, понимание длинного контекста).

В некоторых тестах Astra оказалась слабее даже предыдущей модели. Например, в Humanity's Last Exam она набрала 57,2 процента, а Claude Fable 5.1 — 65. OpenAI опубликовала этот результат, не скрывая его.

Независимые тестировщики отметили ещё одно: тексты Astra пишет хуже прежней модели. Стиль сухой, без индивидуальности. Некоторые вообще не рекомендовали её для творческой работы.

И есть вопрос скорости: Astra отвечает медленно. Первого слова можно ждать до полутора минут. Для чат-бота, отвечающего клиенту в реальном времени, это не подходит.

Что это значит для бизнеса в Узбекистане?

Во-первых, цена. Astra в 2,5 раза дороже прежней модели. Если ваш бот тысячу раз в день отвечает на простой вопрос, Astra увеличит счёт в несколько раз и не даст ни копейки дополнительной пользы. Для простой задачи достаточно недорогой модели.

Во-вторых, место, где Astra даёт реальную пользу, вполне конкретно: работа со старыми системами. На многих предприятиях Узбекистана работают программы без API, и сотрудник вручную переносит между ними данные. Astra начинает брать эту работу на себя.

В-третьих, сторона кибербезопасности. Если ваши данные чувствительны, невозможность проверить ход рассуждений модели — серьёзный вопрос. В таком проекте до выбора модели нужно решить, как она будет контролироваться.

В-четвёртых, и это главное: одна модель не решает всё. В проекте работают несколько моделей. Astra выполняет сложные шаги, недорогая модель даёт простые ответы, третья пишет тексты. Мы в клиентских проектах работаем именно так, потому что это и дешевле, и результат лучше.

Как Tezcode выбирает модель для проекта?

Правило простое: решает не бренд модели, а задача. В начале проекта мы разбиваем задачу на части и на каждую ставим самую недорогую из достаточных моделей.

На практике это выглядит так: в чат-боте для клиента быстрая и недорогая модель, в подготовке отчётов и аналитике средняя, а в многошаговой самостоятельной работе модель уровня Astra. Тогда и счёт остаётся низким, и результат хорошим.

Выход новой модели не означает, что всё нужно на неё переводить. Сначала мы прогоняем её через собственные тесты и только потом ставим в клиентский проект.

Частые вопросы

OpenAI открыла её 3 сентября 2026 года в ограниченном доступе и 4 сентября для общего пользования. Предыдущий флагман GPT-5.6 Sol вышел в июле.
Через API 10 долларов за 1 млн входных токенов и 50 долларов за 1 млн выходных. Это примерно в 2,5 раза дороже прежнего флагмана GPT-5.6 Sol (4 и 20 долларов). Поэтому ставить её на любую задачу невыгодно.
Не однозначно. В последнем замере независимого рейтинга Artificial Analysis Astra и Claude Fable 5.1 набрали равный балл. Astra впереди в работе с терминалом и автоматизации, Claude впереди в научном коде и понимании длинного контекста. То есть выбирают под задачу.
Внутри Astra применена техника recurrent depth, которая затрудняет чтение хода рассуждений модели со стороны. OpenAI в своём документе признала, что возможность отслеживать рассуждения существенно снизилась. Кроме того, модель впервые в истории компании получила критический уровень по кибербезопасности и нашла в тестах две новые уязвимости.
Если задача простая, например ответить клиенту о ценах и часах работы, не нужна, хватит недорогой модели. Astra оправдывает себя в сложной многошаговой работе: взаимодействие со старыми системами, доведение долгого процесса в браузере до конца, работа с большими объёмами документов и кода.
Нет. Сначала мы прогоняем новую модель через собственные тесты: сравниваем результат, цену и скорость на реальной задаче. Только потом, если клиент получает реальную пользу, переводим. В одном проекте работают несколько моделей, каждая на своём участке.

Какая модель подходит именно вашей задаче?

На бесплатной 30-минутной консультации разберём процесс в вашем бизнесе и скажем, какую задачу автоматизировать с ИИ дёшево и выгодно. Без обязательств.

Получить бесплатную консультацию

Ташкент, резидент IT Park. Отвечаем обычно в течение одного рабочего дня.

Для владельцев бизнеса

Начните с бесплатного аудита процессов

За 30 минут определим, где ИИ даст вашему бизнесу наибольший эффект: продажи, клиенты, отчёты или процессы.

14 дней бесплатно — карта не нужнаПоддержка: UZ / RU / ENИнтеграции: POS, CRM и Telegram