
В первые дни сентября вышли сразу две флагманские нейросети. Anthropic выпустила Claude Fable 5.1 первого сентября, OpenAI ответила моделью GPT-6 Astra третьего. YouTube забит роликами, где Astra сама строит модели в Revit, SketchUp и Blender, короткий ролик с ArchiCAD собрал 400 тысяч просмотров, а следом пришла новость, что переписку в ChatGPT читают живые люди. Если ты юрист, инженер, проектировщик или бухгалтер, платишь за нейросеть из своего кармана и работаешь с клиентами, вопрос простой: GPT-6 Astra или Claude Fable 5.1, за что платить?
Ниже сравнение GPT-6 Astra и Claude Fable 5.1 по официальным страницам OpenAI и Anthropic, независимым замерам и роликам блогеров: что умеет каждая модель, где она реально сильнее, сколько стоит и что происходит с твоими чатами. А в конце скажу, что по моему опыту важнее самого выбора модели.
Если совсем в двух словах. Astra делает ставку на то, чтобы работать за тебя в программах на компьютере: кликать, заполнять, строить. Fable 5.1 делает ставку на долгую сложную работу: большой проект, документы, задачи на много шагов, где модель должна часами вести дело без твоего участия и не потерять нить.
| GPT-6 Astra | Claude Fable 5.1 | |
|---|---|---|
| Выход | 3 сентября 2026 | 1 сентября 2026 |
| Сильная сторона по заявлению разработчика | управление компьютером и программами | долгие задачи на много шагов, код, документы |
| Сколько текста держит за раз | около 1 млн токенов, ответ до 128 тыс. | 1 млн токенов, ответ до 128 тыс. |
| На входе и выходе | текст и картинки на вход, текст на выход | текст и картинки на вход, текст на выход |
| API за 1 млн токенов | $10 вход, $50 выход | $10 вход, $50 выход |
API здесь это подключение модели к своим программам и сервисам с оплатой за объём текста, а не подписка. Миллион токенов это примерно несколько толстых книг, которые модель держит в голове за один разговор. Но это окно в API: в подписке ChatGPT оно меньше, 256 тысяч токенов на Plus и 400 тысяч на Pro. Что это значит на практике и почему модель всё равно забывает начало, я разбирал в статье про контекстное окно нейросети. По объёму и цене за токен модели почти близнецы, разница в том, где каждая сильнее.
Главный козырь Astra в том, что она работает с обычными программами так, как работал бы человек: видит экран, двигает мышь, печатает. OpenAI называет её лучшей моделью для работы с компьютером. На официальной странице анонса показаны живые примеры: разводка печатной платы в KiCad, финансовая модель в Excel, дашборды в Power BI, модель коробки передач в FreeCAD с анимацией в Blender, дом в Blender с прогулкой в Unreal Engine 5, юридическая записка в LibreOffice Writer, сцена в Unity.
Что важно знать до того, как радоваться:
По цифрам OpenAI, на тесте управления компьютером OSWorld 2.0 Astra решает 72,6% задач и тратит около 40 минут на задачу против 75 минут у прошлой модели. В той же таблице Claude Opus 5 набирает 70,2%, цифр Fable 5.1 там нет, а сама Anthropic измеряла свою модель на другом наборе задач. Получается, в тестах OpenAI Astra обходит и прошлую модель, и Opus 5, но независимо сравнить Astra с Claude в управлении компьютером пока нельзя.
Я поручил агенту-исследователю собрать ролики про Astra на YouTube. За две недели их набралось около трёхсот, из них сотня в конкретных программах. Вот что показывают чаще всего (просмотры на 18 сентября):
Роликов, где Astra работает в 1С, Photoshop или Компасе, на момент написания не нашлось.
А теперь то, чего в заголовках роликов нет. Агент прочитал описания самых популярных, и где способ подключения указан, почти везде программа подключена к модели не через клики по экрану, а через мост. Чаще всего это MCP: открытый стандарт, через который программа даёт модели свои команды напрямую, без мыши. Придумала его Anthropic, а поддерживают и ChatGPT, и Claude. Revit, SketchUp, 3ds Max, AutoCAD, Blender и DaVinci Resolve в роликах подключали через MCP, SolidWorks и Premiere Pro через сторонние надстройки. Автор ролика про DaVinci прямо пишет: это не управление компьютером и не курсор, который бегает по экрану. У ролика с ArchiCAD способ подключения в описании не указан.
Отсюда два вывода для тебя:
По словам Anthropic, Fable 5.1 это модель для самых тяжёлых задач и долгой работы без присмотра. В новой версии шесть направлений улучшений: многочасовые сессии с кодом, работа с документами, таблицами и слайдами от первого вопроса до готового файла, многошаговый поиск в интернете, чтение плотных графиков и таблиц в PDF, работа по всему окну в 1 млн токенов и управление компьютером. Эксперту из этих шести важны в первую очередь два: документы и длинное окно, когда в работу надо загрузить всё дело целиком.
Что стоит знать:
Таблиц две, и каждая рисует своего победителя.
В таблице OpenAI Astra впереди на большинстве строк, но даже там Fable 5.1 обходит её на экзамене Humanity’s Last Exam с доступом к инструментам (65,0% против 57,2%) и в старой версии независимого рейтинга Artificial Analysis. При этом у Fable 5.1 в таблице OpenAI прочерки в 23 строках из 40, а часть цифр за Claude OpenAI посчитала сама или взяла у другой версии модели. Это не цифры Anthropic.
У Anthropic своя таблица, но Astra в неё не попала вовсе: Fable 5.1 вышла на два дня раньше.
Поэтому я смотрю на независимые замеры. Artificial Analysis в своём индексе от 7 сентября ставит обе модели вровень: по 53 балла. Разница в другом:
И ещё один показательный замер. Andon Labs гоняет модели в симуляции небольшого бизнеса на год: агент сам закупает товар, ставит цены, общается с поставщиками. По шести прогонам Astra закончила год с капиталом почти втрое больше, чем Fable 5.1, а Fable 45 раз впустую заплатила поставщикам вперёд. Это один тест, а не приговор, но как ориентир по деловой хватке агента он полезен.
В сухом остатке: кто «умнее», по тестам не решается. Решает твоя задача и то, сколько ты готов заплатить за один и тот же результат. Мне в этих таблицах важнее всего строка с ценой задачи, её в роликах не показывают.
Бесплатно ни одной из моделей нет. Дальше разница в подписках.
ChatGPT:
Claude:
Одинаковая цена за токен не означает одинаковой цены за задачу: по замеру выше Fable выходит в 2,3 раза дороже. И посмотри на лимит Plus: от 5 сообщений за 5 часов для ежедневной работы с Astra это мало.
Теперь про новость, из-за которой многие напряглись. 14 сентября издание 404 Media опубликовало расследование о внутреннем проекте OpenAI под названием Project Lily: сотни подрядчиков читают настоящие переписки пользователей ChatGPT и оценивают ответы модели. Официального заявления OpenAI по этой истории нет, журналистам компания сослалась на свою справку.
А справка OpenAI говорит прямо: переписку могут просматривать сотрудники и доверенные подрядчики, в том числе для улучшения моделей, если ты не отключил эту функцию. Для личных тарифов обучение на чатах включено по умолчанию.
Как это выглядит у каждой компании по официальным правилам:
ChatGPT:
Claude:
Что из этого следует для эксперта. Персональные данные клиентов, документы с тайной и всё, что ты не показал бы постороннему, в обычный чат не отправляй ни в ChatGPT, ни в Claude. Обучение проверь в настройках каждого сервиса, а в рабочих чатах не ставь лайков.
Теперь сводим всё вместе и переводим на язык обычной работы.
Бери ChatGPT с Astra, если твоя рутина живёт в программах: таблицы Excel, дашборды, CAD, формы на сайтах, CRM. Если хочешь, чтобы нейросеть не советовала, а сама сделала в программе, то по заявлению OpenAI у Astra здесь фора. Независимых замеров управления компьютером пока нет, так что проверяй на своей программе.
Бери Claude, если твоя работа это большие проекты с кучей материалов, очень длинные документы и задачи, которые модель ведёт часами. И смотри не только на Fable 5.1: Opus 5 в API вдвое дешевле по базовой цене.
И неприятная для хайпа правда: большинству экспертов флагман не нужен вообще. Письмо клиенту, пост, разбор документа на 20 страниц спокойно делают модели классом ниже, то есть младшие модели того же сервиса, которые есть в обычной подписке. Флагман оправдан, когда задача длинная, сложная и ошибка стоит дорого.
Как проверить это на себе, а не на роликах:
Скажу честно, откуда мой взгляд. Мой контент-завод, который сам готовит и публикует посты, работает в Claude Code (программа, где Claude работает с папкой проекта и файлами) на тарифе Max. В записи прогона 16 сентября на панели статистики аккаунта стоит Opus 4.8, это модель прошлого поколения, ниже и Opus 5, и Fable. То есть завод работает вообще не на флагмане. GPT-6 Astra в своей работе я не тестировал, поэтому сравнение выше собрано по официальным страницам, независимым замерам и роликам, а не по моим впечатлениям.
На своей работе я вижу одно. Результат решает не столько флагман, сколько порядок вокруг него: правила проекта и отдельный проверяющий, который ищет ошибки за основной моделью. Как это устроено, я разбирал в статье про команду ИИ-агентов. Флагман без правил это дорогая ошибка, а не дорогой результат.
GPT-6 Astra и Claude Fable 5.1 по общему уму сейчас идут вровень, и спорить, кто круче, бессмысленно. Astra делает ставку на работу в программах и дешевле за задачу, но самые яркие ролики с ней держатся на мостах, большинство из которых подключается и к Claude. Fable 5.1 сильнее в долгих проектах и очень длинных документах, но дорогая и медленнее других моделей Claude. По приватности разница в подходе: у Claude выбор про обучение показывают при регистрации, у ChatGPT обучение включено по умолчанию, выключать его надо самому в настройках.
Что реально работает, где ломается и сколько это стоит. На своих задачах, с цифрами, без магии и обещаний. Подпишись, чтобы не собирать это по чужим постам.
Подписаться в телеграмеНе пользуешься телеграмом? Те же разборы в группе ВКонтакте.