Последние месяцы в гонке искусственного интеллекта происходит что-то очень странное. Мы привыкли, что выходит новая модель, значит, она должна быть лучше предыдущей. Но сегодня в реальных задачах все чаще бывает наоборот. Старые версии оказываются стабильнее и иногда справляются лучше новых. Но я, конечно, не говорю про Claude Fable. И именно сейчас OpenAI ставит на паузу обучение своей следующей модели Astra, самой крутой, самой передовой, на фоне вопросов к ее поведению и безопасности. Это просто временная техническая проблема? Это маркетинг? Или сама гонка искусственного интеллекта начала меняться?
Почему сегодня может выиграть совсем не тот, у кого самая новая и мощная модель? Сегодня это разберем. Всем привет! Мы на канале ToTheMoon — технологические новости, инсайты из Кремниевой долины по всему миру.
А, Ильнар, слушай, ну что ты скажешь по поводу темы, что OpenAI остановила, остановила разработку frontier моделей, ну, таких, как, ну, то, что подразумевается под передовыми моделями, и именно обучение этих передовых моделей. То есть то, что они описывают, это что? Это чтобы самые их современные модели поставили на паузу с точки зрения их личного собственного обучения, да? И там примерно так это описывается на простом языке. И в заявлении Сэма Альтмана было это написано, что они в рамках модели Atlas, да, по-моему, они сейчас.
В рамках модели Astra. Это следующее поколение модели после пять-шесть, после модели Sol, да? Наверное, это не тут вопрос не, не пять-шесть, вопрос Sol. Следующее поколение модели, что якобы эта модель, там, неуправляемая, что с ней может быть огромное количество рисков с точки зрения, там, киберпреступности или безопасности, или любого типа преступности. Но вообще, когда Сэм Альтман про это написал, я вообще подумал: а зачем тогда про это писать? Ну, то есть представим, вы делаете какие-то модели, и логично, что у вас происходят разные обстоятельства и разные сложности, и разные неуправляемые вещи.
И вы делаете эти тесты внутри у себя, они происходят разные неуправляемые вещи. Зачем про это рассказывать? Вот есть полезные вещи. Anthropic провел очень огромное исследование по тому, как работают агенты массово. Это, кстати, очень интересная тема, как агенты между собой договариваются или как они друг друга мочат. Я про это рассказал несколько дней назад в выпуске. Если кто-то не смотрел, посмотрите. Но здесь история все же другая. Вот они выходят, рассказывают про модель как раз еще в преддверии того, что у Anthropic все же уже вот вот публичное размещение, вот, значит, IPO, вот очень дорогое IPO. А, Anthropic показывает как никогда большую выручку.
Заявляют о том, что у них в ближайшие годы выручка может достигнуть, там, двести восемьдесят миллиардов долларов, там, по триста миллиардов долларов в год. И не является ли это со стороны OpenAI некоторой такой закидкой, что якобы у OpenAI есть какая-то сверхъестественная модель и какая-то невероятная, да? Помните, я, я почему-то все время говорил, что даже предыдущая версия с Hugging Face мне казалась маркетинговой. Она вроде как не маркетинговая, потому что там Hugging Face в ФБР пожаловался, но она мне до сих пор выглядит как будто какой-то подстроенной, потому что я не вижу под 5.6 Sol такого качества, которое есть у Fable. Ну вот хоть убейте, не вижу.
Ну, вот я, конечно, ни в коем случае не человек, который занимаюсь, там, системами безопасности или какими-то вот, ну, такими серьезными штуками, но по мне Fable другого уровня вообще, чем 5.6 Sol, да? И вот эта закидка их про Astra — это их последний путь или действительно они сделали что-то невероятно крутое?
Слушай, каждая новая модель последней, вот если брать, там, большие именно переходы, давала существенный прирост по многим показателям. И, соответственно, здесь тоже можно в двух аспектах смотреть. С одной стороны, сейчас из-за вот всей этой истории между крупными, ведь, компаниями и правительством США, у них есть свои ограничения, да, они не могут слишком свободную, слишком крутую модель выпускать, им все равно ее залочат, да. И как бы здесь, с одной стороны, можно прочитать так: наша модель уже настолько хороша, что дальше улучшать ее не надо.
Мы сейчас ее будем дотачивать по каким-то параметрам, потому что если мы будем ее еще более крутой делать, мы, соответственно, там, не пролезем через вот эти вот ограничения, которые нам дают. Вторая история. Они опубликовали статью по безопасности, да, и то, что вот изо всех этих инцидентов, которые произошли, они начали много усилий тратить на отслеживание того, а что же делают их агенты. Потому что многие проблемы же возникают, не когда агента в свободный мир выпускают, да, то есть, ну, прям такой активности нету, а их начинают проверять. Ну, им давать какие-то задачки. И вот выполняя эти задачки, агенты как side effect совершают, вот, там, условно, с Hugging Face начинают шалить, да, там, или еще какие-то вещи происходят. По крайней мере, вот на этапе обучения внутри OpenAI, то, которое вот сейчас задокументировано.
Да, соответственно, OpenAI начали отслеживать не только действия, да, которые агент совершает во время решения. То есть это вот function calling, то есть какие инструменты он вызывает, да. Но начали еще отслеживать вот сами размышления, reasoning trace, да, вот, грубо говоря, как моделька думает, когда совершает какие-то действия. Соответственно, у тебя получается огромный объем данных, который сверху дополнительно необходимо еще отслеживать. И, по моему, по оценкам, до 20 или 25% мощностей, которые уходят на обучение, сейчас начинают уходить на вот как бы анализ этих трейсов, которые есть, этих вот последовательностей вычисления. При этом, соответственно, если какой-то триггер срабатывает, что вот модель ведет себя не так, как нам хотелось бы, и в течение 30 минут не удается там как-то автоматизированными способами этот вопрос решить, да, тогда, соответственно, весь процесс останавливается до того, как мы вручную в этом разберемся.
Соответственно, эта остановка на две недели, если вот по этой ветке рассуждений идти, может быть следствием того, что они просто не могут понять, а каким образом вот вылечить то поведение, которое модели стали проявлять. Ну и соглашусь с тобой в любой ситуации Сэм Альтман и PR служба OpenAI все равно хочет какие-то бенефиты с этого получить. И на эту новость тоже можно вот с двух аспектов смотреть. С одной стороны, они делают что-то неуправляемое, чем они сами не могут управлять, поэтому они останавливаются. И это как бы в минус компании. С другой стороны, они говорят: "У нас есть настолько крутая вещь, мы сейчас вот ее допилим, но это просто сумасшедшая история. Мы даже остановили обучение просто потому, что то, что мы сейчас сделали, это уже очень круто".
И, собственно, таким образом тоже пытаются какие-то очки заработать. Вот. Поэтому тяжело так однозначно сказать, потому что все равно несколько аспектов у этого есть.
Но основная история в том, что GPT-6, скорее всего, немножко откладывается. Были новости, что, возможно, там, в конце августа у нас уже появится следующая номерная версия. И вот подразумевалось, что Astra как раз будет готова к этому моменту, и, наверное, она была бы готова, если бы не было вот там проблем, с которыми они столкнулись. Но, скорее всего, она сдвигается. Более того, со всеми этими историями, со взломами Hugging Face и прочее, я думаю, что им не так просто еще будет пройти проверки в правительстве США. Поэтому, скорее всего, у нас немножко эта история откладывается.
Также в конце августа, плюс-минус по срокам, по ощущениям было, что у Claude, у Anthropic выйдет также следующая версия. Но пока дополнительных новостей на эту тему я не слышал. Возможно, тоже пока немножко эта история откладывается. Надеюсь, что вот в начале осени какими-то новыми моделями нас порадуют.
Ну, здесь вообще сейчас история интересная, что, с одной стороны, мы наблюдаем гонку, ну и всегда наблюдали гонку вот этих апдейтов моделей. Но что произошло, мне кажется, за последние два месяца фундаментально. То есть появились модели ChatGPT-5.5, и там вот этот режим Extra High, появился Opus 4.8 Max, да? Я помню, это был прямо пик, когда ты заходил, начинаешь делать какие-то задачи и видишь прямо правильное изучение архитектуры, анализы большие, разработки прямо серьезных блоков кода или серьезного конечного результата, да. Среди простых приложений можно было делать серьезный конечный результат. То есть ты смотришь такой, прямо хороший, классный результат.
Дальше что произошло? Появился Fable, и Fable по вообще всем аспектам, по-моему, и всех людей, и описаний, и всего, он действительно как будто что-то новое привнес. И он даже не то что новое привнес с точки зрения длительности работы и качества выдержки вот этого, вот этого единого пути. Мне кажется, что он привнес, он привнес фундаментальное качество результата. То есть он совершенно по-другому видел результат. У него какая-то была другая скорость, как будто там оценивал задачу пятнадцатилетний человек. А тут вот пришел взрослый, взрослый человек и серьезно, значит, реализовал эту задачу, да?
Прямо это я не знаю, ты чувствовал это? Я прямо, я прямо это чувствовал. А дальше пошла…
Саш, да, что называли PhD в кармане у каждого появился, да? То есть это вот мы стали ближе к этому.
Хотя про PhD-то давно говорили, да. А дальше что произошло? Вот появился Opus 5 я сейчас говорю про, про большие системы, смотрите, даже про большие, вот в максимальных тарифах, потому что я уже не говорю про простые системы, я даже простые не рассматриваю. Появился Opus 5 у Claude, и появились вот это новое семейство моделей, где Luna, Sol, Terra у ChatGPT в Codex. И что-то пошло не так вообще. То есть, с одной стороны, они вроде как бы говорят: "Мы тут сделаем кучу всего крутого".
И ты как будто видишь что-то. Даже было похоже, что это 5.5, просто которая может работать, не останавливается которая, да? Но в то же время понеслись бесконечные глюки. И я что вижу сейчас? Мне кажется, есть некоторая деградация. Что раньше, по сути, 4.8 Opus решал лучше задачи, чем сейчас решает Opus.5. Вот просто лучше. Вот что ни делай. Я вообще в моих тестах, мне кажется, я даже до сих пор возвращаюсь во многих местах к 4.8, если нету Fable, да? И он делает задачи часто лучше, чем Opus.5. Opus.5 уходит непонятно куда. Вот, например, у ChatGPT не Codex, который как чат, вот у него развитие в целом шло достаточно неплохо и планомерно. Там бывали некоторые моменты иногда, когда про версия, какие-то глюки были, но в целом шло все нормально.
Но в последнее время, например, 5.6 Sol про версия, во-первых, постоянно сбивается ползунок. Если честно сказать, мне кажется, просто это, это просто я, я, ну, это, это минус всем вообще, всем руководству вообще, всем людям, которые это делают, это про-это просто невозможно. То есть он сбивается везде. Это крик, крик, крик волчика. Значит, но это полный непрофессионализм, конечно, абсолютный непрофессионализм в частности разработки. Но я что вижу, что и 5.6 про версия, она иногда стала Кардинально странные вещи выдавать.
Нет ли такого, что они потеряли стратегию понимания того, куда они эти системы делают, что они по-настоящему хотят создавать? И они хотят создавать AGI или они хотят создавать системы для кодинга, или они хотят создавать чаты, для которые используются в бизнесах. То есть, что они хотят делать? Потому что Сэм Альтман позавчера в одном из интервью, у них была партнерка с компанией, которая бесплатно открыла сервис по разработке софта на базе версии Tera. И я сижу, и Сэм Альтман говорит: "Вот как классно!
У всех появится бесплатная возможность делать софт". Я сижу, думаю: а в чем суть этого софта, если у ChatGPT есть бесконечно бесплатная версия Tera по умолчанию? И зачем эти отдельные системы делать? То есть зачем они нужны? И, по сути, любой вообще человек может открыть Codex и начать что-то там делать. А Сэм Альтман еще сказал такую фразу, что, кстати, наши зрители на эту тему думают, что все смогут быть предпринимателями и все смогут себя попробовать предпринимателями, что-то создать. Я подумал: слушайте, ну, если вы хотите попробовать быть предпринимателем, во-первых, у вас есть бесплатная версия, но дальше вы можете купить за двадцать долларов обычную версию плюс.
Потому что если вы хотите быть предпринимателем, у вас должно быть двадцать долларов, да? Вы покупаете обычную версию плюс, и у вас появляется Codex с достаточно нормальным объемом токенов для того, чтобы что-то сделать в целом. И что, что это за паразит, за паразитизм вообще какой-то? Вот рассуждения про масс-маркет вот или он это говорил опять же для маркетинга этой системы, чтобы эта система начала стоить дорого и потом OpenAI, не знаю, какие-то акции в этом получил. Или, может, у Сэма Альтмана там есть акции у этой компании. Вот очень много сейчас такого творится, да?
Есть нормальные сделки, классные. Вот, вот закрыл сделку Grok вместе с Cursor. Но это на самом деле не Grok, а SpaceX, который владеет xAI, который владеет,
который, у которого продукт Grok, да? Он закрыл сделку. Кстати, можно было бы сегодня сидеть так. Он, он, он закрыл. Ну, раз правильно он закрыл сделку, закрыл сделку. Ну, мы о ней на самом деле рассказывали еще две недели назад, мне кажется, да? И чем эта сделка примечательна? Очень четко и понятно, что и xAI будет выходить на рынок программирования. Сто процентов, да. И очень серьезно рынок программирования. Потому что Cursor — это охренеть серьезная система. И при объединении с Grok они, конечно, сейчас, ну, должны будут начать полноценно начать конкурировать с Codex и с Claude.
И плюс Google не отступает, да? Все же Google, вот у них есть Gemini, они выпустили 3.7 Flash как раз для программирования агентных задач. И Google не отступает от программирования. Поэтому что вообще происходит, в частности, стратегии? У Anthropic вроде как стратегия как была, так и осталась.
Но вот судя по тому, что они делают, какие они выпускают исследования, эссе, какие они пишут конституции, полностью все. А у ChatGPT и у OpenAI, у них действительно мировой рынок всех пользователей, про которых они забывают, потому что они ползунок сраный сделать не могут. Вот. А, ну, в кавычках. А при этом они заявляют вот про Astro.
Ну, смотри, тут как бы и проклятие, и благословение того, что они сделают очень и очень универсальный продукт. То есть это не какой-то инструмент, который решает одну конкретную задачу. Да, ты можешь приложить его много где: и в обучении, и в программировании, и в бизнесе, и в творческих направлениях, где угодно. Anthropic сделали вполне себе конкретную цель и к этой цели движутся, да? Вот у них есть там основное направление, связанное с AGI безопасностью, и по ходу еще решаются вопросы с программированием.
Здесь мне что вспомнилось, я об этом уже вот какое-то время думаю. Все то время, пока мы, все то время, пока мы пишем этот подкаст, у нас постоянно есть как бы вот базовый уровень, на котором работают модели, и есть всякие фишечки, с помощью которых можно сделать так, чтобы они работали лучше. Ну, вот о чем я? В самом начале надо было промпт хорошо писать. Да, были большие гайдлайны по тому, как писать промпт. И вот там начиналось: ты эксперт в такой-то области, пиши так, как будто бы это, и вот это что-то значило.
То есть твой обычный промпт от вот такого заковыристого, он как результат отличался. Дальше, соответственно, появились возможности, там, по API подключать какие-то дополнительные сервисы. Это было сделать достаточно сложно. На базовом уровне этого не было, но вот как бы продвинутые пользователи могли и получали какие-то с этого бенефиты. И вот дальше вот у OpenClou эта история с оркестрацией, и все это съедалось крупными компаниями. То есть сейчас неважно, какой промпт ты пишешь, можно левой пяткой бить по клавиатуре, получить что-то хотя бы отдаленно напоминающее, что ты хочешь сделать.
Он разберется, он разберется, он сделает. Интеграции с всевозможными сервисами есть уже внутри из коробки. Оркестрация огромного числа агентов тоже есть внутри, доступна из коробки. Тебе для этого ничего делать не надо. И вот как бы, ну, почему я это вспомнил, да? Ты вот говоришь, что вот есть какой-то сервис, с помощью который под капотом держит OpenAI Terra, и с помощью него можно там генерить софт. При этом любой человек это сейчас уже может делать. Это станет еще проще в следующей итерации, там, через месяц, через два, через три совсем это просто будет делать.
То есть все равно большие компании это съедят. Текущая фишка, которой вот все носятся, — это скиллы.
Есть большое количество разных скиллов, там, я не знаю, от Карпаты, от Meta, постоянно забываю фамилию, добавим в комментариях. Например, там есть, skill Grill Me, который помогает тебе разобраться с какой-то темой, с которой ты вот хочешь дальше работать, да? То есть он задает тебе все вопросы, обсуждает, дает какие-то рекомендации, и вот вы полностью строите карту того проекта, который вам нужен. Ну и огромное количество других, скиллов. С одной стороны, с этим можно разбираться, в это можно погружаться, ну, условно, быть там на один месяц впереди всех остальных. Но все эти вещи, они будут интегрированы все равно внутрь того же Claude, того же ChatGPT и будут доступны из коробки всем остальным пользователям.
Это вот как бы один point, да? У нас всегда есть какое-то движение вперед, которое потом съедается крупными компаниями с созданием софта с помощью вот этой вот компании Terra. Если вдруг это вот не проект Сэма Альтмана, будет абсолютно то же самое. И второй пункт по поводу того, что нас ждет дальше, какие дальше модели и так далее. Есть два основных пути улучшения. Один путь — это базовую модель улучшить. Это вот ждем GPT-6, ждем, там, Fable-6 или еще какие-то другие модели.
А другая история — это из текущей модели выжать больше возможностей, которые есть. До этого это было: мы добавили там MCP, и у нас появился дополнительный контекст. Мы добавили возможность там бить задачу на суб-агентов. У нас там тоже ситуация кардинально изменилась, хотя сама базовая модель под капотом не так сильно могла измениться. И здесь то же самое. Если у нас там дальше будет откладываться вся история с ChatGPT шестым, там, и прочими какими-то моделями, компании найдут, как из текущих моделей можно выжать больше. Более того, рынок уже это делает, и, скорее всего, это просто все дальше будет интегрировано.
Вот у меня такой небольшой монолог, надеюсь, никого не запутал на вот эту вот мысль, которой мне хотелось поделиться.
Слушай, ну, здесь интересный очень аспект, что, по сути, ведь, сейчас рынок не требует ни от кого, чтобы кто-то торопился разрабатывать сверх какие-то модели.
Они могут параллельно разрабатывать крутые модели и улучшать работу текущую. Не просто там кнопочку где-то перемещать, да, или какой-то микроглюк решать, а улучшать, ну, по-настоящему прямо улучшать работу, которую вот мы видим, полгода не изменяется вот эта линейная структура управления, там, проектами или чатами. Очень много неудобного, да, или неправильно там какие-то названия, имена называются. Или периодически какие-то глюки в системах, и ты не понимаешь, глюк был или не был.
Или у Claude открываешь страницу, он тебе пишет, сколько ты токенов потратил за всю жизнь, ты кликаешь за неделю, он тебе пишет нули. То есть он какие-то данные не дает. То есть огромное количество микро вот этих вот глюков, которые, мне кажется, очень сильно влияют на повседневную жизнь людей и на то, чтобы человек еще больше привязывался к этой системе, по-настоящему привязывался, не хотелось с нее мигрировать. Потому что вот я был сильнейшим адептом OpenAI и ChatGPT с точки зрения ежедневной деятельности и им остаюсь.
Но с точки зрения программирования, очевидно, у меня уже месяц как 80% работы происходит в Claude, а не в ChatGPT. Я продолжаю использовать Codex много на разные задачи. Мне нравится, как и делает он ряд вещей, в частности, там, анализа, скачивания данных с разных ресурсов, там, анализа данных, всяких аудио, там, текстов, каких-то микросервисов, которые внутри есть. Вот как я там какую-то ерунду делал, там, распознавание, людей, животных на камере возле дома, возле гейта, вот, или какие-то свои там финансовые вещи. То есть целый ряд вещей, где я пользуюсь, но все равно большие, самые фундаментальные вещи я стал делать в Claude Fable. То есть я на него как бы, по сути, мигрировал. И от того, что ChatGPT выпустил новый режим, его так описывают, а OpenAI выпустил новый
режим, 5.6 Sol Ultra Fast, и ты такой типа: «, ну, ребята, ну в чем прикол?» То есть, во-первых, 5.6 Sol — очень дорогая модель, и Ultra модель очень дорогая, жутко дорогая. Я вообще удивлюсь, если по API, я удивлюсь, по API огромное количество людей в мире и компаний это ее используют. Ну, вот массированно, прямо везде, только ее и все. И они берут делают режим Ultra Fast. Мне кажется, если ты используешь, ChatGPT 5.6 Sol Ultra или даже Extra High, ты не торопишься никуда. Ты скажешь: «Ничего страшного, я подожду». Правильно? Как с Fable, наверное, как бы я не хочу платить в Fable полтора икса за стоимости.
Если я плачу, там, не знаю, $1 тыс. За запрос, я могу подождать для $500. То есть кто не может подождать из того, у кого эти системы бесплатные? Ну, вот, наверное, сам Anthropic или OpenAI, может, может это делать. И у меня вопрос: зачем они это выпускают? Это как был вопрос, зачем они выпустили ChatGPT Pro за $100. То есть абсолютно странная, ну, странная, абсолютно странная история. Хотите заработать денег? Так выпустите режим за $2 тыс. Да? Или хотите заработать, больше, еще больше денег? Тогда продавайте более качественно плюс версию для обычных пользователей.
Нет, Саша, я не начала, потому что, в общем-то, как мы уже до этого обсуждали, что то, что он мне предлагает, это были какие-то очень базовые, шаги, до которых я сама дошла. Конечно, он мне их составил, допустим, там, за пять-десять минут, а у меня это, наверное, несколько месяцев, давно заняло как-то самой пройти, но как бы дальше это развить, я не смогла.
Ну, вот здесь, кстати, здесь получается очень интересный аспект, что у тебя есть старое воспоминание Codex, условно, одну из, там, первых версий, выпущенных и когда начали её использовать. И у тебя положен на-на этом крестик. У тебя есть ощущение, что эта система, она так же и работает, и непонятно, что в ней делать. Хотя я хочу сказать, что, у тебя же много, очень много бизнеса, профессиональной деятельности, и в том числе с разными клиентами, и, в частности, Codex невероятно круто с этим помогает. Но даже когда этого нету, вот, например, у моей жены этого нету, я недавно уже своей жене сказал: "Слушай, есть, прикольное решение — Codex. Ты вот эту свою задачу можешь, там, решить". Она мне сказала: "Так это отдельная программа?" Я сказал: "Нет, это тот же ChatGPT, просто отдельная программа, отдельный application". И она, скорее всего, конечно, его не запускала и не делала, но я просто знал, что ей было бы полезно там для обработки некоторых вещей в почте постоянных запустить Codex. Но, получается, людям это не показали или людям это не донесли, или люди не увидели простой кейс.
И мне кажется, нехватка в мире сейчас огромная среди людей, которые не сверх сильно интересующиеся искусственным интеллектом, а искусственным интеллектом немного людей интересуются. Даже если посмотреть количество, людей, которые смотрят, там, наш канал или другие каналы по искусственному интеллекту, их не так много прямо, их не, их не сотни миллионов. То получается, среди, вот потребителей ChatGPT даже платных. Вот моя жена, у нее платная версия, там, за $20, да? А она не, знает, а что можно делать еще. Это как они ползунок не переставляли и не знали, что есть более хорошая версия.
Они не знают, что делать еще. Или, например, у меня есть подруга, и когда-то я ей посоветовал версию купить вместе с папой. И она говорит: "Вот у меня версия вместе с папой, я не могу там что-то спрашивать". Но вместе с папой надо было покупать два года назад. Сейчас уже давно надо иметь свою версию, да? То есть, а у людей есть старое вот это ощущение, она мне еще говорит: "А что вы?" Она, представляете, мне говорит! Это было, это, конечно, было очень смешно. Она говорит: "А что у вас разные ChatGPT, вы что каждый по $20 платите?" Я когда это слышу, я понимаю, насколько люди относятся к ChatGPT как до сих пор, да, что $20. То есть эта же девочка идет кофе пьет за $10 ии легко.
А тут, значит, $20 в месяц в ChatGPT. Нельзя, чтобы в семье было две подписки. Ну, это звучит, в, ну, это звучит, вроде как безумно, но это, это тупо. На самом деле, это тупо, это неразвитость, неведение и все. Но, с другой стороны, это реальность мировая.
И поэтому все же вот то, что OpenAI сейчас, не сильно прогрессирует в части взаимодействия с обычным пользователем, по крайней мере, мне так кажется. Будем смотреть, что у них будет происходить, и, что у них будет получаться. Я надеюсь, нет, нет шанса, что OpenAI, там, проиграет или у них не получится, потому что там здоровая массивная организация уже с сумасшедшей инфраструктурой, вложенными сотнями миллиардов долларов в стороннюю инфраструктуру, там, сервера, во все остальное. Они будут делать модели, но хотелось бы, конечно, чтобы они делали интересные вещи.
А возможно, Anthropic выйдет, на IPO, у них будет оценка больше трех триллионов, они привлекут много капитала, не упадут в оценке и, захватят вот этот рынок консумеров, которых, мне кажется, им очень сильно не хватает, и улетят вперед. Вот. Кстати, к слову, напишите, наши зрители, и, Ильнар, вот у тебя здесь интересно. Я до сих пор вижу огромную фундаментальную разницу, например, в создании отчета или HTML
в чате GPT-5.6 Pro в чате или даже в Claude Fable. Fable, очень важно. Fable в Max или в Ultra Code, в Claude Code. То есть в Claude Code он все же создает что-то, как, не знаю, упрощенное, что ли, или такое более кодовое, ну вот не, не вот это интерфейсное, не визуально не клевое почему-то. Почему-то у меня такое вот впечатление. И это до сих пор, наверное, является аспектом, почему я не мигрировал. Вот я знаю, Ильнар, ты же мигрировал практически полностью в Codex, да, извне ChatGPT, да?
У меня, Саша, это связано больше с тем, что подавляющее большинство задач, запросов, которые я решаю с чатом GPT, они связаны с айтишкой, с программированием, с data science. И это мне удобнее просто делать в Codex. Есть большое количество проектов, каждый к каким-то репозиториям подключен. И, собственно, с этим и связано то, что мне в ChatGPT ходить уже, ну, особо нет смысла. Бывает иногда какие-то вопросы, ну, такие, по старинке запросы, хочется, чтобы, там, какое-то исследование провести, еще что-то такое.
Тогда да, я пользуюсь, но все реже и реже, все чаще просто внутри Codex я уже остаюсь. Что касается отчетов и презентаций, да, для себя я выработал такую схему, и в целом она меня полностью устраивает. В ChatGPT Я собираю весь контекст, который необходим для презентации. То есть это может быть по какому-то проекту, по проведенным экспериментам, по еще какому-то объему. Ты собираешь всю необходимую информацию. Это может быть несколько месяцев работы, например. Потом, соответственно, совместно с ним бьешь это на какие-то смысловые блоки, получаются какие-то слайды.
И дальше, чтобы это было красиво, это я делаю в Claude Design, потому что из ChatGPT заставить сделать красивую презентацию у меня пока, по крайней мере, не получается. Claude Design не может собрать весь этот контекст. Тебе нужно его ему дать. А вот, соответственно, в ChatGPT собрать контекст, отнести его в Claude Design. Claude Design кинуть еще в виде референса либо гайд по созданию презентации, который вот принят там, я не знаю, на конференции, в компании или еще где-то, либо уже готовые презентации, которые ты говоришь: вот сделай похожим образом.
Вот с этим он справляется. То есть получается, что вот собираю контекст я в чате GPT, потом с этим контекстом и с примерами иду в Claude Design. Дальше буквально две три итерации и получаются очень, очень неплохие результаты, которые руками я бы, ну, никогда бы я такую презентацию не собрал. А здесь получается дешево и быстро. Обычно так не бывает. Но вот как бы…
По-настоящему альтернативы. Я могу сказать, что я пока не знаю альтернативу такую. Может быть, кто-то скажет, что, например, в Figma, возможно, или, там, ну, в разных системах можно что-то делать более крутое, суперпрофессиональное. Но я хочу сказать, что качество именно разработки дизайна разного вида, да, с нюансами где-то, да, какими-то погрешностями, но все, что касается приложений, веб-сайтов каких-то, там даже бывает пресс-графиков, мне не нравится в Claude Design экспорт.
Мне кажется, он работает очень тяжело, глючно, не до конца верно. Не все системы понимают, что там отдельно происходит. Тоже, кстати, вопрос к Claude Design почему они это нормально не сделают? Прямо конкретный глюк, прямо тупой, полтора месяца. Вот. Но качество системы невероятно крутое. И опять же, у меня вопрос как рынок дальше продолжает использовать сторонние решения? Вот как есть система Lovely, да? Или как она? Lovable. Как правильно? По разработке мобильных…
Lovable обычно говорят.
Lovable, да. При разработке мобильных приложений. У нее сейчас был новый раунд, и она привлекла дофига денег. Там, по-моему, оценка у нее была больше десяти миллиардов долларов. И я такой сижу все время себе и говорю: а зачем мне использовать эту отдельную систему, если я могу в Claude Code или в Codex сделать вроде как то же самое? И да, там есть какие-то дополнительные фишки, более чуть-чуть легкие интеграции. Но все же, если вы хотите по-настоящему что-то развивать дальше и смотрите чуть шире, но гораздо фундаментальнее, правильнее сразу же это делать в Claude Code или в Codex, а не там.
И, кстати, Claude Design мне не хватает, чтобы Claude Design был как будто встроен в Claude Code, и чтобы я мог прямо там внутри попросить это делать или дальше с этим продолжить работать. Потому что ты когда делаешь экспорт, он потом что-то теряет, у него нет этих файлов. И опять же становится вопрос зачем вы создаете такие продукты? То есть если вы хотите иметь вот эту сквозную интеграцию, очевидно, что человек будущего, даже текущего, настоящего, если человек делает веб-сайт, вот самый масс-маркет такого дизайна, например, веб-сайты, да. И если ты делаешь веб-сайт, то это надо все в одном месте делать, в одной точке. И когда у тебя есть связанная одна точка, ты не будешь, например, Claude Design передавать в Codex.
Сейчас я могу Claude Design передать в Codex, что я, собственно, иногда и делаю, а могу передать в Claude Code. Но если бы он был бы встроен в Claude Code, то меня бы еще больше Claude Code бы связал бы с собой. Так же, как появление в Claude Code и в Codex браузеров убрало вот эту проблему лишнего раза самому посмотреть в браузере, лишнего раза куда-то зайти. То есть наличие внутренних браузеров — это невероятно мега прямо крутая, супермодная вещь. Какие-то другие системы знаешь?
Как раз вот для каких-то таких визуалов я долго его не трогал, я к нему пошел, когда у меня из ChatGPT не удалось вытрясти нормальные презентации. Я начал смотреть, а что еще может. Тут, собственно, подписка Claude у меня есть. Думаю, дай попробую. И я был сильно удивлен, насколько лучше результат был у Claude Design, чем у, там, пять-шесть Ultra со всеми этими наворотами, которые можно там накрутить. Да, как-то в комментариях тебе писали, даже ты, по-моему, озвучивал, что вот, делая дизайн в, там, в Claude Design, вы получаете все одинаковый дизайн.
Но тут надо только вспомнить, что, например, дизайнеры, которые учатся в одном и том же университете, на одном и том же факультете, в одной и той же группе, они все будут делать по-разному, потому что разный бэкграунд, разные запросы, разные у тебя как бы в зависимости от входа, то есть от того, какие данные ты даешь на входе, у тебя выход будет сильно отличаться. И здесь как бы от того, какие ты референсы даешь, какой ты промпт, как бы это ни звучало в 2026 году, задаешь, какие там у тебя есть внутренние, там, настройки, общий контекст и прочее, выход будет сильно отличаться.
Вот поэтому тут, если кто-то переживает, ну, переживать по этому поводу не стоит, всегда можно просто референс дать и сказать: вот хочу такое.
Ты имеешь в виду с точки зрения одинаковости дизайна?
Да, да, да. Ну, больше были опасения в комментариях.
Я вижу, что очень сильно отличается и, ну, просто невероятно сильно отличается сейчас, в частности, от того, что он не делает.
Мы, кстати, сделали уже полную версию ToTheMoon, то есть всех наших выпусков как раз таки с помощью Claude Design и всех карточек. Ну, это скорее история такая, как небольшое промо, да? Потому что все равно люди смотрят наш выпуск в YouTube и для гиков, и для людей, которые сильно нас любят. Но в чем там плюс? Там есть более, по-моему, 25 тысяч разных связанных связок между собой тем, тегов, компаний, всего. И поиск работает космически быстро, и можно посмотреть в любой момент времени, когда мы упоминаем, кого, где упоминаем, как упоминаем.
Ну, короче, система работает достаточно интересно с точки зрения поиска, что, ну, фундаментально интересно, да, вот, в частности всего. А это я что хочу сказать? Это сделано как раз я сейчас открою, покажу. Это сделано как раз таки с помощью Claude Design было сделано. То есть вот наши выпуски все полностью. Она сейчас находится там в невыпущенной, условно, тестовой версии, она скоро выпустится. И вот у нас у каждого выпуска есть разметки, есть все компании, которые участвуют в каждом выпуске. И вот, например, это выпуск от 9 августа, да? И вот кто в выпуске, кто в центре внимания, кто является дополнительными историями, какие главные линии разговора у нас там были. Вот, например, можно открыть там карточку компании OpenAI и посмотреть, что OpenAI упоминалась в 148 выпусках, 98 — в центральной роли, 22 продукта и модели OpenAI и начали упоминать с апреля 24 года по август 26-го. Или поиск у нас есть, у нас поиск работает.
Чем прикольно? У нас можно ввести даже Беларусь, например. И вот написано, что Беларусь — это страна. Вот в каких выпусках было краткое упоминание, можно посмотреть. Можно посмотреть, как, какие месяца, Ильнар, какая у нас была нагрузка упоминания Беларуси, да? И даже видишь, в центре выпуска у нас ни разу не было. И это и прикольно. Вот, например, Индия. Если открыть Индию, вот у нас Индия была в центре выпуска один раз. Помнишь, мы с тобой выпуск ввели в 25-м году в мае про образование.
И в и вот можно посмотреть, что существенный разбор, например, у Индии был там несколько раз. Ну и понятно, что есть взаимосвязанные вещи, например, очень интересные, да? То есть когда вы понимаете, в частности, например, здесь система понимает, что, например, Франция, что Франция и "Мистраль", например, — это связанные между собой вещи, да? Ну, очень много есть прикольных конструкций, очень интересных конструкций. И, ну, работает это. Вот мы "Мистраль", кстати, представляешь, в 19 выпусках упоминали. Если кто-то, кстати, говорит, у нас же люди любят говорить, что мы, например, что мы про кого-то не рассказываем, да? Так вот, если кто-то считает, что мы про кого-то не рассказываем, то вот оно сразу же видишь, что это и Франция, и везде, где было. И вот покрытия все, и вплоть до минут можно посмотреть в контексте чего и когда, и что упоминалось, и что где было.
Здесь есть расшифровки наши, понятно, полностью все. Так вот, если кто-то считает, что мы кого-то не упоминали, помнишь, обделяли какую-то систему. И, кстати, говорили всегда, что мы Anthropic не упоминаем. Anthropic. Anthropic. Вот. Ну, Anthropic явно меньше, да? В центре выпуска 25 раз, в отличие от OpenAI. Но все же Anthropic, смотрите, на протяжении всех наших выпусках присутствовал всегда. Вот смотри, какую он крутую штуку сделал. Он сделал понятия связанных сущностей с Anthropic.
Видишь? И можно даже зайти, посмотреть, что Claude Design в центре когда был выпуска или когда там был Anthropic в центре выпуска. Он достаточно серьезно. Что важно? Вот этот дизайн делал Claude Design. И Claude Design, например, была самая прикольная вещь, когда я ему сказал: "Не карточки сделай. Одно дело тебе сделать вот эти вот карточки. Другое дело тебе было сделать...". Ну, здесь очень много всего есть, да? Даже вот, там, он знает, там, компания программного обеспечения Atlassian, там, или вот McDonald's у нас был там, и два упоминания в центральной роли.
У нас действительно недавно, как вы знаете, у нас был ключевой был разбор по, по McDonald's. Я его снимал. Вот 7 августа был. Видите McDonald's? Вот он. Так вот, одно дело было сделать такие карточки. Я хочу сказать, что сам дизайн выглядит невероятным. Ну, ну, ну, в плане, в плане скорости разработки. С другой стороны, Ильнар, он мне сделал, вот предложил мне, как должен выглядеть вот этот поиск вот здесь, как он, как должен выглядеть поиск в плане, вот визуально. И он с первой попытки написал архитектуру такого поиска, с первой попытки. И дальше мне Claude Fables с первой попытки его внедрил.
И причем внедрил невероятно большую скорость. Я хочу сказать, что скорость, с которой работает этот поиск, она очень крутая. Я, я, наверное, я сделал сотни, наверное, разных сайтов или проектов, и разных систем. Но легкость создания вот такой системы по нашим, по всем выпускам, да, их там, может, не сверхъестественно много, но все же их большое количество. И вот, а! Вот здесь вот есть покрытие 32 тысячи разных пересечений тегов, меток, слов, 892 сущности, 153 выпуска. То есть это достаточно серьезное покрытие, ну, очень серьезное покрытие. Здесь еще не появляется у нас, он появится на сайте, потому что есть сайт, который относится, не этот, а есть сайт, который относится к… Компания Solid. Это там есть мои личные проекты.
ToTheMoon просто является участником как связующим звеном этих проектов. Он появится отдельно у нас в рамках Solid, но он имеет отдельный стиль и отдельный дизайн. Ильнар, кстати, обрати внимание, что вот этот дизайн достаточно сильно отличается от дизайна вот этого. То есть он абсолютно сильно отличается по всем аспектам, но имеет какие-то связующие вещи. И вот Claude Design смог это все сделать достаточно просто и легко. Верстку делал Claude Fable, но и разработку там частично делал Fable и Codex.
Хотя, кстати, разработку ToTheMoon делал только Fable. И я хочу сказать, что я иногда понимаю, что мне лучше выделить ресурс, но сделать на Fable, чем мучиться и переходить в другие системы. В последнее время все, что касается особенно качества верстки, иногда, конечно, поражаешься. Система не может встать самую тупую, простую страницу, элементарную, вообще самую простую. А иногда вот такие вот сложные, казалось бы, карточки. Но ты сам знаешь, что это выглядит непросто. Вот то, что я показываю, делает невероятно круто, четко, точно.
И здесь появится еще много различных интересных вещей. Но даже мне кажется, Ильнару и Тане они еще это не видели, кстати. И сегодня это видят и наши зрители, и видят сразу же Ильнар с Таней. Мне кажется, что и Ильнару, и Тане будет интересно. Если надо, можно всегда найти, всегда абсолютно найти. А в каком выпуске мы про что разговаривали? То есть это нам как редакционной компании, конечно, это имеет большое значение. И я невероятно под впечатлением, насколько серьезно, конечно, современные, что, насколько серьезно современные модели могут делать.
Потому что в мире сотни миллионов сайтов или там 1 000 000 000 сайтов это уже похоже даже на некоторую платформенность. Все же, давайте по-честному. Это не просто какой-то микро-сайтчик, потому что даже если перейти, в частности, там, на у меня на сайт, там достаточно большая структура базы знаний. Вот здесь поиска статей, деталей всяких связанных между собой конструкций, но очень много всего связанных, не знаю, связанных структур, там картин с разными медитативными выпусками.
Короче, чего только нету. Это похоже на платформенность. И эта платформа, конечно, эта платформа. При этом при всем это достаточно все же простой сайт. То есть это не какой-то бизнес, который продает платформенность большую, там огромную. И это все сделано очень простыми инструментами. И всем зрителям, кто там кричат, что значит, нужны какие-то злостные архитекторы, программисты, невероятно какие-то дизайнеры, верстальщики, не знаю, кто еще, но я бы задал вопрос, потому что это все сделано мной лично одним.
И, как вы знаете, у меня много всего. А он, кстати, полностью работает на английском языке. Конечно, у нас все есть на английском языке, и у нас все эпизоды есть на английском языке, и у нас все транскрибации есть на английском языке, и все выпуски есть на английском языке, и все связанные сущности на английском языке, и описание всех компаний всего полностью тоже есть на английском языке. Все темы есть на английском языке. К слову, кстати, тоже даже вплоть до обложек или до всех деталей.
Вот, ну, здесь это, кстати, не тема, хотя мне кажется, что нашим зрителям интересно увидеть, в частности, то, что относится к нашему проекту ToTheMoon. Правильно? Но я здесь это показывал еще как пример. Очень классный пример того, что того, где сегодня находятся такие системы, и, в частности, жалко, что пока люди, я не знаю, смогут ли люди делать такое легко. Вот, например, у Тани же большое количество проектов, сайтов, всего это можно невероятно сильно так все развивать. Но получается, чтобы это сделать, надо одновременно знать и что такое архитектура, и что такое системный анализ, и что такое бизнес-анализ, и что такое верстка, и что такое фронтенд-программирование, что такое капчи и что такое куки, и что такое согласие пользователей, и что такое аудио транскрибации и так далее.
К слову, кстати, вы знаете, что Codex сейчас вы можете зайти и сказать себе: "Спарси мне, пожалуйста, вот этот вот YouTube-канал полностью все выпуски со всеми обложками, со всеми описаниями. Подключи мне вот LLM Labs тебе токен, распознай мне полностью все аудио". Он, значит, все вам полностью распознает и привезет вам в текст. И вы сами можете построить такую модель взаимосвязи. Вы представляете, на какой уровень мы вышли? Невероятно! Кстати, Ильнар, знаешь, есть же разные системы, которые распознают голоса.
И я настолько недоволен был распознаванием ролей во всех системах и в LLM Labs, и в ChatGPT, что я в итоге написал с помощью Codex свою систему распределения ролей и локальную. И она берет на вход, может взять там 1000 часов аудио и всего. То есть распознанного аудио распозналось LLM Labs. LLM Labs все еще выигрывает в качестве русского языка и выигрывает в качестве русского языка, в том числе у новой модели. ChatGPT выпустил новую модель. У них было четыре о Transcribe. Они выпустили новую модель Transcribe, самую современную.
Она стоит дешевле. Очень близкая цена к LLM Labs, но они все равно проигрывают у него. И при этом я написал свою модель распределения ролей. Так что прикольно. Мы же очень много выпусков снимаем вместе с вами в ToTheMoon или мы снимаем, я снимаю для личного. У меня есть личное развитие человека. Есть духовное развитие. Например, Таня участвует и в других каналах. Периодически она у меня ведет интервью, спрашивает. И вчера, значит, эта система, она говорит есть шестьсот девяносто шесть нераспознанных фрагментов людей.
Не могу распознать людей. Я говорю: "Для обучения модели присылай мне пачками голоса и прямо в Codex". И она мне присылает фрагментики пятисекундные, там, семисекундные фрагментики. И там, значит, идет Танин голос, там, Ани Гурин голос, там, Ани Волчек голос. Ну, разные голоса идут, там, Оли идут, там, Саши Минеева, там много разных людей, да? И идут эти голоса, и ты такой: "О, это голос этого человека, этого, этого человека". И она дальше дообучается. Она дообучается и говорит тебе: "У нас там уровень распределения голосов, например, 99% выходит".
Вот. А, понятно, еще раз, чтобы вроде такое создать, я говорю, что это очень легко и так далее. Ильдар сейчас посмеется, скажет, как с Карпатом тогда: "Ты все же, Волчек себя не м, ты не простой разработчик сайта". Но получается, вот я недавно снимал выпуск, здесь у нас, ToTheMoon, он индивидуальный выпуск был один. Это не в рамках нашего подкаста воскресного. Я говорил про то, а какие люди станут, что будет с программистом. И я там выразил как раз таки гипотезу, что ведь появляется огромное количество людей новых, которые будут себя называть программистами или называться разработчиками.
И вот какая кто из этих людей сможет прорасти? Потому что чтобы создать то, что я сейчас показал, одновременно надо быть всеми ролями хотя бы в понимании того, что происходит, да, и в понимании бизнеса. При этом, конечно же, я не дизайнер, далеко и ни в коем случае я там не архитектор сейчас, там, и я не напишу сам лично код. Вот. Ильдар, какие у тебя впечатления, кстати, от поиска?
А, ну, это прикольно. Появилась летопись ИИ глазами ToTheMoon, да? То есть можно будет…
Да, да, да, да.
...через какое-то время смотреть, а что там у нас все-таки было, как мы развивались и, собственно, как индустрия развивалась нашими глазами. Вот зрителям, надеюсь, тоже будет это интересно. А что касается сложности, да, что вот ты говоришь сейчас, чтобы это создать, надо, вот там, набором компетенций владеть, да. Но если отмотать на год назад, на два года назад, гораздо больший объем компетенций для этого был нужен. Сильно все упрощается. И нет гарантии, что через полгода с появлением следующих моделей, следующих харнесов, как их называют, обвязок, да, не будет это решаться одним промптом, да? Тебе не нужно будет ни про архитектуру задумываться, ни про верстку, ни еще про что-то.
Ты делаешь один запрос, говоришь, что вот тебе YouTube-канал собери. Сейчас это так не работает, но я думаю, что в ближайшем будущем мы в эту сторону пойдем.
Да, может быть, это и не надо будет. Знаешь, как я хочу, Ильдар, сказать? Я даже делая это, я не уверен, что это надо будет в плане в будущем. Потому что, потому что я же сам адепт и, и рассказываю про то, что сайты не нужны становятся вообще, что понятие сайта как такового, в нем нет никакой необходимости. В то же время я помогаю AI-моделям, поисковым системам анализировать, а про что мы рассказываем на самом деле в ToTheMoon. А не просто абстрактно говорить, что мы какая-то компания и про где-то, про понимаешь, да?
Где-то, про все даже такой анализ чтобы сделать, на это надо потратить большие вычислительные мощности. И на сегодняшний день искусственный интеллект не будет тратить вычислительные мощности для того, чтобы проанализировать, что такое YouTube-канал ToTheMoon настолько. Он посмотрит какие-то там где-то параметры, не знаю, скажет какое-то число подписчиков, которые у компании есть. То есть он это не сделает. Но в целом я понимаю, что при нормальном при нормальном искусственном интеллекте, который бесконечно все анализирует, изучает, изучает все видео, все каналы, он, по идее, и сам должен к этому прийти, правильно? То есть, по идее, AGI должен сам со всех каналов все миллионы YouTube-видео иметь вот такие, ну, это уже какие-то космические семантические ядра, да? Вот, иметь их внутри.
Но, по сути, чем и является сам искусственный интеллект. Он же, он же этим и является. Чтобы он смог дальше по-настоящему высказываться, что-то или описывать, или про что-то говорить.
Фича-реквест на проект: добавить еще парсинг комментариев и, соответственно, по комментариям создавать репутацию наших зрителей.
Это все будет.
И там потом давать какой-нибудь приз самым лояльным, самым добрым комментаторам.
Я хочу, кстати, Ильдар, сказать, что для меня наличие сайта, в том числе возможность, так как у нас есть все же очень сильные участники ToTheMoon, слушатели, а так как, ну, мы в индустрии и есть возможность какие-то даже людям интересные фишки давать больше какие-то или промокоды, ну, какие-то детали даже, не промо каких-то. Сайт дает возможность дальше разворачивать дополнительную инфраструктуру. Все, что касается разных чат-ботов, все, что касается работы, вот как ты говоришь, с комментариями, даже пересмотреть наши все выпуски и посмотреть, а как люди на протяжении длительного времени, какие люди точно выпуски, ну.
И мы составим это, кстати. Точно, да, Ильдар? Мы сделаем на сайте рейтинг, рейтинг комментаторов, и уже никто не сможет обмануть задним числом. Он же уже будет текущий и уже будет опыт. Два года, два года не, не сможешь ты это сделать, да? То есть ты задним числом комментарий не создашь у нас.
Это вот как Саша сейчас говорит, что мы для AGI помогаем и создаем, там, экономим его будущие вычислительные мощности. Это явно зачтется в будущем, когда AGI появится. Вы также, когда оставляете комментарии, тоже об этом думайте, что все ваши комментарии в дальнейшем будут использованы для обучения AGI. Вдумчиво оставляйте комментарии.
Да. Всем спасибо большое за сегодняшний выпуск. Увидимся с вами ровно через неделю. Вы на канале ToTheMoon. Не забывайте нас, поддерживать наш канал, комментировать, лайкать, рекомендовать друзьям. Всем пока.