Всем привет! Мы на канале To The Moon раз в неделю новости, инсайты из Кремниевой долины и по всему миру. Технологические новости, инсайты, технологические. Ребят, привет!
И для меня вот удивительно, что как бы фандинга нельзя сказать, что мало. В Human AI, по-моему, проинвестировали по оценке триста миллионов. Просто что они делают там pathetic AI. Но это как бы все находится пока на уровне тезисов, а не на уровне как бы как выглядит конечный продукт. Это меня очень сильно удивляет.
Что за чушь? Я извиняюсь, куда они вообще пошли? Почему эта система начинает работать через визуальный интерфейс?
И вот этот меморандум устанавливает ограничительные меры с точки зрения искусственного интеллекта, включая Пентагон. Там, разведывательные службы документ запрещает применять искусственный интеллект для запуска ядерного оружия. Там...
Что интеграция LLM с абсолютно любыми программами становится на шаг ближе.
Ну, там получается задача дается некоторый бюджет, ну, сто долларов, тысяча, десять тысяч, сто тысяч и смотришь, что агент может сделать, когда у него задача тупо максимизировать прибыль. И там, на самом деле были позитивные результаты.
Столько прошло выпусков, где мы всегда были четыре человека. Но сегодня первый выпуск, где мы втроем. Следующий выпуск мы опять будем вчетвером, и Таня назад к нам вернется. Вот. Нас здесь обычно четыре человека, еще есть Таня. Слушайте, я хочу с такую тему быстро начать и ее проговорить.
Мне кажется, она такая интересная, достойная внимания, особенно сейчас с учетом того, что в США через неделю выборы и ровно через неделю, по крайней мере, от этой съемки, когда выйдет, останется несколько дней, когда выйдет видео, вам уже будет несколько дней. Байден подписал меморандум по поводу нацбезопасности, устанавливающий ограничительные меры для искусственного интеллекта. Такая очень, мне кажется, интересная история, особенно которая всегда важна. Почему это делает президент в конце своего срока? Ну, то есть, вот если делать в конце своего срока, особенно с учетом того, что там сейчас вообще непонятно, кто выиграет, и настолько сильные канди--противовесные кандидаты против друг друга, ну, как бы они очень противовесные. Да. Бывали кандидаты, когда они такие, смешивающиеся очень, рядом стоят, а эти очень противовесные. И вот этот меморандум, если кратко пояснить, про что он, он устанавливает ограничительные меры с точки зрения искусственного интеллекта для госучреждений, там, включая Пентагон, там, разведывательные службы документ запрещает применять искусственный интеллект для запуска ядерного оружия, там, для всяких слежки, религиозных нападок, разные вещи, да. И плюс говорит о том, что важно не вмешиваться. Защищи--защитить технологический сектор и AI от зарубежного шпионажа. То есть вот в обратную же сторону там есть. Что такое защитить на уровне государства? То есть, с одной стороны, вроде никуда не вмешиваться, с другой стороны, защитить. Там такое приличное количество пунктов меморандума, которые есть. И что вы думаете с точки зрения применения? Почему Байден решил это выпустить и резко в это влез? При том, что Байден вообще никак в этом году, ну я уже не говорю про прошлое, не высказывался по поводу искусственного интеллекта. Ну, какие-то там микро вещи, просто микро стандартные вещи.
Да. То есть с моей стороны это выглядит как политическая история. Возможно, это то, что они хотели сделать давно, но так как он сейчас не участвует в выборах, то, может быть, они считают эту меру непопулярной. Да? Если они хотели это сделать и считают это непопулярной мерой, то логично это сделать сейчас, а не потом. Потому что потом, ну, условно говоря, это придет на Камалу, да, если они верят, что они победят, и это будет, и это будет как бы сразу ей тяжело начать с этого, может быть. Может быть, так я не знаю, но как будто бы это вот как раз связано с тем, что он хочет какую-то меру внедрить сейчас, пока. Или, или я не знаю, или, может, он думает, что они не победят. И в общем, какие-то у меня такие теории заговора, я не знаю. Но это как бы да, это абсолютно нелогично. То есть, но, но, к сожалению, то есть в американских реалиях такое, такое вполне можно рассчитывать, что такое случилось, да.
Да. Это даже выглядит, как будто это и не Харис проект, как будто она с этим не связана. То есть это как будто со стороны это, это выглядит и что тоже вызывает вопросы. Мало того, мне кажется, там те пункты, которые перечислены, это такой масштабная, большая история, которая, которая очень круто было бы новому президенту показать, да, и рассказать.
Там, кстати, есть очень интересный пункт по поводу того привлечения иностранных специалистов, которые работают в области ИИ, и он указан тем, что привлекать иностранных специалистов в области искусственного интеллекта инженеров и чтобы они не работали на конкурентов. Пункт прямо такой отдельный есть, да, на уровне государства. Вот это интересно. Ну а, кстати, по поводу частных компаний там есть очень четкое указание, что частные компании обязаны предоставлять государству доступ для того, чтобы анализировать, делать, ну, госконтроль. Со стороны искусственного интеллекта. Я не сильно, кстати, верю, что искусственный интеллект не будет использоваться в, э, в оборонной промышленности. И особенно с тем, что говорится про спецслужбы и про шпионаж. Мне кажется, они в полном объеме используют. Кто, как не они, используют данные, там, machine learning и сверху вообще все это на обработку будут насаживать. Что-то себе не представляю. Они как отстанут от Китая по, по движению в этих вещах. Ноо-
Саш, они там первые.
Да, они там первые, они там первые с первыми местами. То есть вот это, м, интересное, что-- интересная история, мне кажется, ее надо наблюдать. Это первое, ну, такого уровня, по крайней мере, политик, да. До этого мы говорили, что губернатор Калифорнии, у нас были выпуски прямо, мы рассказывали про то, как они, на что влияют, как Калифорния как передовая страна, с одной стороны, поддерживает очень ограничения по-- с точки зрения защищает частные компании от разработки и чтобы ИИ развивался. Такая тема, да, достойна внимания. И, ну, будем за ней следить. Будем за ней следить, смотреть, что по ней происходит.
По поводу военных и спецслужб в ИИ и прочем. Понятно, что это там не искусственный интеллект, а machine learning. Вот в том примере, который ты сейчас будешь приводить. Но когда я занимался computer vision, очень популярный, да и сейчас он очень популярная модель есть YOLO. Это модель по детекции и классификации объектов на изображениях, ну и в частности, там, на видео, да, используется, там, для, э, опять же, для детекции объектов. Чтобы понять, есть объект на фото, видео или нет его. Ну и, собственно, там, трекинг объектов, слежение за объектами. Так вот, создатель этого фреймворка, я, к сожалению, не помню уже его имя, но он участвовал в этом прорывном проекте до третьей версии YOLO, а потом он из нее ушел и ушел он из морально-этических соображений, что военные стали использовать этот фреймворк в беспилотниках. Тогда еще просто это слежка была и в подобных системах. И он по морально-этическим нормам отказался от развития этого проекта дальше. Проект развивается просто уже, там, другими исследователями. Я просто к тому, что уж кто-кто, а военные спецслужбы и все остальные давным-давно первыми хватают все только то, что появляется.
Ну что? Антропики выпустили новую модель. GPT выпустила o1, и было интересно, чем же смогут ответить Антропики. Антропики ответили, но на самом деле ответ оказался весьма и весьма необычным. Да, вот у нас, э, была новость, что вышла Claude 3.5 New и помимо каких-то, э, таких не очень заметных изменений, появилась возможность, э, развернуть систему так, чтобы она получила доступ к локальному компьютеру, да. Чтобы она условно мышкой двигала вместо вас. Программами пользовалась вместо вас, заходила в браузере, э, запускала какой-то поиск, анализировала выдачу. Ну, то есть, по сути, делала то же самое, что можете сделать вы. Только, собственно, ваш компьютер становится под управлением LLM. Что думаете? Насколько это путь в ту сторону, куда LLM надо развиваться? Куда, вот, интерфейсу надо развиваться?
Ты имеешь в вид, что в ком-- да, в комментариях, что в комментариях ребята все написали, да, кто смотрит. Кто смотрит, наши, а, зрители, напишите, пожалуйста, в комментариях на эту тему тоже. И про эту историю. И ты что думаешь? Ты у нас еще спрашиваешь?
Да, да, да. И вы что думаете, конечно.
На мой взгляд, это правильный шаг. На мой взгляд, это правильный шаг, потому что, грубо говоря, с релиза чата GPT... Основная интуиция была такая, что должен поменяться поиск и должен поменяться пространство персональных ассистентов. Много стартапов подняли много фандинга про персональных ассистентов. Ни у кого не получилось добиться никакого traction. То есть мне это неизвестно. Грубо говоря, есть разные--
Грубо говоря, есть разного рода направления, да? Первого-- первое рода направление — это RPA. Это, грубо говоря, есть люди, которые делают достаточно много такой повторяющейся работы, да, например., например, там, когда, с-- насколько я понимаю, в 3D-моделинге, там достаточно много такой ра-ра-работы. И казалось бы, что модель может посмотреть очень много, там, не знаю, мы говорим про десятки тысяч часов и научиться воспроизводить движения мышкой. А второе — это такое консьюмерское направление. Это вот просто как вот работа менеджера устроена в любой американской компании. Там одну информацию получил, передал в другое место, составил некоторый список фоллоуапов, сделал эти фоллоуапы. По этим фоллоуапам нужно еще каждый день, ну, обновлять контекст, что произошло, посм-- понять, ну, как бы пришло много апдейтов, нужно заматчить свои фоллоуапы с этими апдейтами. В общем, и вот как бы такой information management, то, что делают фактически все сре-- весь средний, весь middle management, грубо говоря, во всех компаниях, по крайней мере, в Америке точно. Иии да, бы-- как бы давно был premise, что должен быть как бы персональный ассистент, который стру-- который вс-- который как бы структурирует все это по папочкам, да, как это раньше было, но, вот который так или иначе это структурирует, предлагает некоторые action items и заодно помогает приоритизировать как бы эти проекты и назначать звонки. Потому что еще там назначение звонков, особенно в корпорациях, это такой очень сложный процесс. Там все должны друг под друга как-то подстроиться, у всех бесконечное количество встреч. Иии это в принципе работа, то есть это в принципе работа как бы с таблицами очень простыми, без, без каких-то сложностей с докуме-- то есть с текстом., почти нету работы с визуалом, да? То есть нету работы с-- почти с картинками, то есть разве что с графиками., нету вообще работы с видео, нету, может быть, работа с аудио, но только на уровне meeting summary и работа с календарями, да? То есть, казалось бы, что уже модели, они на самом деле хороши с этим. То есть все-таки календарь — это же у него есть там метаданные, и, и это не обязательно прям как бы распознавать как, как картинку календарь, да, воспринимать. Все-таки там есть метаданные, которые это описывают. Иии мне кажется, что как бы последние два года вот прогресс как бы застыл. То есть, вот ну такой thinking, как вот то, что я описал, он уже был как два года, но никто не сделал реальный прогресс. То есть, да даже прикольных демо не было. И сейчас у-- сейчас Claude как бы, заявил об этом. Они-- пока я не видел работающих workflow, но как минимум люди уже это пробуют. Это уже большой прогресс вперед. И то, что они ворвали, то, что они все-таки, а-а-м, выпустили, как бы, как по-- то, что они это выпустили, это очень сильно подтолкнет и OpenAI, и Google. И здесь начнется серьезная конкуренция., до сих пор совершенно непонятно, кто победит и как выглядит интерфейс компании, которая победит. Но как минимум дело с-двинулось точно с мертвой точки, и мы точ-- и, и как бы корпораты, они не меняются. Корпораты лучше всего реагируют на конкуренцию от других больших компаний. И мне кажется, Anthropic этим самым как бы запустил вот эту индустрию, да? Потому что как бы венчурные компании, они двигались ооочень медленно, ну, прям ооочень медленно. Даже ни одной крутой демки не было за два года. Нечего обсуждать было. Очень круто, что Anthropic сдвинул дел-де-дело с мертвой точки и сделал больше, чем демо. Уже дает пользователям попробовать.
Ну, это реально начнут использовать и применять? Какое будет сейчас развитие у этой функциональности?
Я не знаю. Я пока не видел прим-- удачных примеров применения, к сожалению. То есть это пока я могу только, пока я могу только это
спекулировать.
Вот здесь у меня, знаете, когда я в первый раз увидел, первая реакция была: «Да что за чушь? — я извиняюсь — куда они вообще пошли? Почему, эта система начинает работать через визуальный интерфейс?» Условно. Вот если, например, вы хотите в вашем приложении узнать погоду в Сан-Франциско на какую-то дату, например, да? Как это будет делать человек? Человек условно зайдет, откроет браузер, в Google забьет, там, «погода Сан-Франциско, такое-то число», и в выдаче будет искать какие-то результаты. Программа так делать не будет. Программа по API постучится в, сервис, который предоставляет информацию о погоде, и оттуда все это получит. Это будет гораздо быстрее, точнее и, соответственно, вроде как правильный подход. Что сделали Anthropic? Да, Anthropic показали, что теперь Claude умеет условно не по API стучаться в эту систему, а умеет так же, как пользователь, открывать браузер, и, собственно, гуглить, какую-то информацию, которую он мог бы получить, да? И как будто бы выглядит, что вот система в обход пошла. Потом, соответственно, ну, вот начинаешь думать: ааа какой профит-то от этого есть? Какая польза есть от того, что вместо того, чтобы система напрямую друг с другом общались, они начинают, там, дублировать пользователя. Единственное, что я смог придумать, это то, что системы теперь получают доступ, LLM-системы получают к любому программному обеспечению, даже если API для них не открыли. Условно, Microsoft Office, да, вряд ли Claude откроют прямой доступ, чтобы, соответственно, работать с этой информацией. Или там какой-то сервис, да? Конкурирующие компании, скорее всего, откроют доступ только, там, к своим сервисам, к своим LLM, к своим системам. А здесь получается, что если хорошо работает вот это, взаимодействие с системой через user интерфейс, через графический интерфейс, тогда с любой программой, с которой человек может взаимодействовать, и LLM тоже начинает получать возможность для взаимодействия. И в этом смысле интересно. В этом смысле получается, что интеграция LLM с абсолютно любыми программами становится на шаг ближе. Да, получается, что неважно, производитель по-- предоставил такую возможность или нет. Если человек может этой системой пользоваться, тогда и LLM тоже можно дообучить для использования этой системы, используя вот этот подход, который Anthropic показали.
И в этом смысле это выглядит интересно.
Не до конца. А, вот, и как ты говоришь, с самого начала кажется странным, как Саша сказал, что, по сути, никто не знает, какой будет будущий интерфейс у-- вообще у этих систем и как это должно выглядеть. Но явно есть необходимость в том, чтобы отсутствовала вот эта вот интеграция по API или кто-то кому-то дает доступ, да? Потому что огромное количество систем, э, не, не будет иметь ни при каких обстоятельствах никакого доступа и никакого API. И это, наверное, какое-то решение. Я просто не пред-- я очень много есть действий, которых делаю, повторяющихся, и, ну, я просто не представляю себе, как это можно сейчас, по крайней мере, переложить на какое-то, насколько это должно быть, что это должна быть за система, которая все, все детально поймет. Возможно, это поиск, да? Возможно, это поиск, может быть, какая-то дополнительная data о пользовательском опыте. Возможно, вот этот сценарий, который нам открыли, он же явно не конечен. То есть это какая-то история, которая позволит моделям и, ну, вот, в движении туда в AGI, да? Для того, чтобы дать како-каких-то больше данных о настоящем пользовательском опыте. Потому что, по сути, эээ, сейчас вот эти текущие окна чатов или про-- спрограммированного интерфейса какого-то, э, вместо взаимодействия с LLM-ками, он же очень ограничен. То есть это все время часть какой-то. То есть система до конца не знает, зачем ты эти данные получаешь. То есть ты хочешь узнать эту погоду, потому что она тебе сейчас нужна для, эээ, того, чтобы, там, не знаю, куда-то поехать, или ты хочешь узнать погоду, потому что ты вписываешь ее в какой-то отчет. То есть она не понимает, она же не знает вот этих вот данных.
И, наверное, если дать вот этот доступ широкого формата, это становится неплохо, интересно, да. И что-то новое, что-то по-другому. Кстати, по поводу что-то новое у Apple появилось. Вот они добавляют там микро разные фишки. Эээ, то, что они анонсили, работает частично, но, по крайней мере, начало, например, работать в-- у меня начало работать. Я не знаю, как у всех, у кого какой. Там слишком много обновлений, да, разного типа. Начала работать история с тем, что можно письмо, когда я, когда я-- так как я пользователь почтовых, почтового интерфейса Apple, то я могу внутри редактировать письмо общем, в этом интерфейсе, да? Казалось бы, абсолютно элементарный функционал. И сколько софта на это делалось. Но одно дело — это надо мне, как бы, открывать сторонние программы. Другое дело — это начало работать внутри обычного приложения. Причем прикольно, что в тот момент времени, когда я это увидел, я-- мне надо было проверить качество моего английского языка, там, на уровне профессиональном. А, я отправил это в чат GPT. Потом я вернул, вставлял в Apple, и когда я вставлял, я увидел эту функцию. То есть и я, я понял, что о, прикольно, я бы, значит, в следующий раз бы уже не отправлял.
То есть, вот все получается, все вот эти новые сценарии, такие юзкейсы, и они, ну, опять же, будут вести к какому-то интерфейсу, к какому нам пока тяжело предположить.
Да. Ну, я лично очень как бы по-человечески, очень хочу, чтобы это был, ну, как бы, чтобы input был с voice. Во-первых, это быстрее, а во вторых, ну, типа, очевидно, что, ну, как бы у меня и там у многих, да, то есть те, кто сидит за компьютером, особенно с лэптопом, то есть люди, там осанка нарушается и прочие, да, проблемы. Я очень надеюсь, что
Да, проблемы. Я очень надеюсь, что как раз будет, что это приведет к таким новым моделям взаимодействия, более полезным для здоровья еще. Ну, то есть, мне кажется, блин, просто с этой чат-- чат-строкой все сильно как-то встали на одном месте, в общем.
Да, да, да, да, да, да. Конечно, нужен, конечно, нужен голос. Саш, Саш, очевидно, нужен голос, очевидно, нужен. Нужен.
OpenAI Canvas, там, не знаю, Anthropic Artifacts — это все здорово, но, не знаю, кажется, и там Perplexity, Spaces — это все здорово, конечно, но это не выглядит как major breakthrough. Интересно, но, но с голосом какая-то непонятная тоже ситуация в том плане, что я не могу вот для себя как-то вообще comprehend все, что происходит со звуком, с голосом. Вот у меня пока в голове вообще не укладывается картинка. Сейчас я расскажу вам. Я проанализировал, в общем, ну, мы же занимаемся с вами простран-- в медиа, да? И понятно, что я слежу за всеми конкурентами. И мое изначальное предположение было, что ElevenLabs как бы суперпопулярен, суперпопулярный.
Потому что, ну, всем как будто бы нужно сделать, ну, нужно голос записать, да, там, ч-человека. Казалось бы, какой-то voice over наложить, где-то что-то перевести на другие языки. Казалось бы, суперпопулярный use case, да, ElevenLabs, казалось бы, всем нужен. А, ну, Runway ML он весь Twitter захватил тоже. Я, ну, как бы ощущение, что он просто везде, у меня вся лента — это как будто бы все, все видеооо, складывается впечатление, что все видео в мире делаются Runway уже. Окей. Ну, понятно, что алгоритм под меня обучается, да? Но, но вот у меня вот такое впечатление сложилось. Но это же всегда нужно с числами, да, реальными числами, как бы с реальными показателями сравнивать. И я узнал, что у Suno больше usage, чем у Runway, всех видеоредакторов, Udio и ElevenLabs вместе взятых. И для меня это было настоящим откровением. А, и я что узнал? Что, оказывается, в общественных местах, а, нужно платить royalty за прослушивание трека, да? То есть мы Spotify просто включаем там как бы. А я помню, у меня-- нас тоже было там празднование дня рождения. Я сказал по простоте: давайте вот просто мы Spotify подключим, нормальный трек, нормальный саунд-- ну, там, потому что уже есть как бы плейлисты, типа, там, как, ааа, там, для дня рождения и так далее, да, музыка. Я просто говорю: давайте включим. Нет, так нельзя, естественно, делать. Есть специальная программа, и там идут неко-- там и вокруг этой программы строится некоторая экономика. И да, то есть я, как понимаю, поэтому Suno популярен, потому что можно просто приятную музычку на фон включить, и, и, и это решает конкретную экономическую проблему, особенно там в странах, может, где экономически, там, нету возможности включать копирайтную музыку. Я это к чему говорю? Я это говорю к тому, что в YC какая-то непонятная вообще ситуация для меня. То есть, с одной стороны, модели распознавания стали очень хорошими. Даже мой достаточно сильный акцент уже модели распознают хорошо. ElevenLabs хорошо генерирует голоса, позволяет кастомизировать. Эмоциональность уже достаточно хорошая есть. У OpenAI в их приложении хорошая эмоциональность. В API еще не очень, но так в приложении хорошая. И я, честно говоря, очень сильно, а, удивлен, почему нету никакого adoption. И для меня вот удивительно, что как бы фандинга нельзя сказать, что мало. В Human AI, по-моему, проинвестировали по оценке триста миллионов. Просто что они делают там pathetic AI. Но это как бы все находится пока на уровне тезисов, а не на уровне как бы, как выглядит конечный продукт. Вот это меня очень сильно удивляет. То есть, есть огром-- вот все стартапы в YC, кто делают voice агентов, у них там, там, типа customer support, voice агент — вот это все. Эта вся тема растет очень хорошо, но это как бы B2B, да, в ту сторону. Там, типа в-voice консультанты, voice customer support — это растет. Есть какие-то тезисы во-- на технической стороне, типа вот этот Human compasetic, а продуктов консьюмерских вообще нету. Вот это меня удивляет. То есть capabilities у Suno и у ElevenLabs уже на крутом уровне. Это, это не foundational компании, да? То есть это там, они этого достигли, там, с ресерчем, который стоит там не больше двадцати миллионов долларов. То есть это не-- мы не говорим там про сотни миллионов долларов на тренировки.
Поэтому я очень удивлен.
Слушай, ну, сейчас даже с точки зрения голоса, когда мы говорим про ежедневное использование, все же хорошо работает распознавание голоса и перевод его, например, в текст там или из текста в голос. В то же время вот эта вот реальная речь вживую, она очень сильно проблематична. И то есть сколько бы я ни тестировал интерфейс вот этого голосового общения, которое даже выпустил последнее OpenAI, но все же это... Короче, там вообще не складывается. Они не могут этот вопрос решить. То есть они не могут разрешить вот это реальное общение, ну, как бы в реальном времени, живое, с пониманием огромного количества деталей. То, что круто распознают любой акцент — это факт. Мало того, когда ты ему говоришь на русском англоязычные термины, он их очень круто переводит, вставляет. Или когда ты, ну, то есть он все что угодно тебе творит, да, в реальном режиме. Он тебе может, ты можешь говорить на английском языке, он тебе чисто русский напишет там все, что-- ну вот. Но в реальном режиме это вопрос. То есть производство, наверное, аудио, да, производство И что с этим будет происходить я вообще себе не представляю с индустрией. Все же то, что ты называешь, что в кафе надо платить деньги, если ты на общественном мероприятии включаешь Spotify, это мне кажется только для очень высокоразвитых стран, да? Потому что понятно, что в обычных экономиках люди вообще думают: это как? Это как возможно?
Сейчас пользуются, да. Но нач-- но смотри, точно, точно есть. Если ввели регулирование и есть большое регулирование, то точно будут вводить историю, когда у тебя система будет генерировать, Suno будет генерировать музыку, похожую и подстраиваться под тебя. Мало того, ты в какой-то момент времени просто вообще, наверное, не отличишь, что это и как это, кто это делал, и когда, и когда это делали и так далее, да? Мне немножко тяжело говорить, как слушателю Seventeen Son Seven только в машине, да, только радио семидесятые и только в машине. И все, на этом моя музыка слушание заканчивается обычно. Но люди, которые массово потребляют, конечно, и дополнение то, что творит в соцсетях, да? Вот тренды разные музыки в социальных сетях — это, конечно, это вообще какой-то другой мир. И мне кажется, он другой с точки зрения интерфейса обыденного пользователя человека.
Ну, то есть вот то, с чего ты и начал, да, вот это когда ты сказал, что я не хочу взаимодействовать с этой строкой там и вообще хватит, да? Но посмотрите на машины, автомобили.
Выросла, если бы я мог чаще брать.
Смотрите, посмотрите на автомобили, ребят, в автомобилях вот это вот распознавание голоса — это же просто какое-то, я не знаю, девяностые, но просто очень некачественное. Вот Volkswagen сейчас сказал, что он внедрит к себе Open Air распознавание, но он сам чат туда встроит, да? Но понятно, что сейчас куча кто будет встраивать и что делать, будет ли оно работать нормально. Но я уже не говорю в обычной жизни, да, когда это условно. Мы недавно сидели с моим товарищем здесь у меня в доме, на балк-- на балк-- на террасе, и мы говорили о том, что типа зачем телефон? Если б у меня висели бы какие-то там микрофоны и висели бы колонки, то я бы просто быстро бы задал информацию. Мне бы ответила и все. Он говорит: "Так это Alexa". Он мне сразу же вернулся. Он занимался очень много созданием голосовых систем. Он говорит: "Так это же Alexa сразу". Я говорю: "Ну, только в данный момент времени Alexa — это, это трэш.
Ну, как говорили, продолжу это говорить. Вот и, возможно, это будет прорыв. Тот, кто научится это делать. Просто мы начали с темы вот у Anthropic нового интерфейса. Мне кажется, этот интерфейс, он для нового вида дейты. Иначе я не понимаю некоторые вещи, зачем они их выпускают? Вот как OpenAI Canvas выпустил этот Canvas.
Не, это все, это вообще не понять к чему.
Просто, ну, как бы там есть рабочий сценарий, но просто зачем вообще? Ну, то есть выпустите поиск полноценный. Окей, вот поиск полноценный, потратьте на него время, на интерфейс крутой сделаете, выпустите. Это, по крайней мере, увеличит вам объем пользователей, не знаю, даст вам еще какой-то дейт, но какие-то такие сценарные вещи — это такой какой-то, ну, мне кажется, уже микро штука. Мало того, многие сценарии не будут работать, вот как обработка своей почты. То есть крутыми сервисы никакие не стали. Пока это не будет работать внутри. То есть логично, что в Google Mail, там, у Apple, у всех будут свои обработчики, обработчики писем, да, и рекомендации, и которые рекомендации. Очевидно. Ну, это же.
Ну, это же очевидно, что они это сами все сделают.
Да. И тут я хотел немножко, раз мы сегодня вот эту тему закрыли, затронули с голосом. Важная тема. То есть вышел Apple Intelligence. Я не знаю, как это охарактеризовать.
Это очень плохо.
Это очень плохо. Это очень плохо. И здесь я должен, честно гово
Здесь я должен, честно говоря, здесь я, честно говоря, хочууу-- вот, то есть в моих глазах, да, OpenAI упал. Anthropic как бы поднялся, Apple упал в ноль. То есть я вообще не понимаю, что они делают. Это, это ууу плохо. Иии, честно говоря, хотел похвалить Google. Просто если мы сейчас про кла-- про прикладные применения какие-то прорывные. Первое: меня просили написать reference email, а я с чуваком работал там давно, прям давно. Я прям еле помню вообще, что было. И я все равно не могу ничего конкретного уже написать. Google автоответом мне дал такой email, чтооо там пришлось поправить буквально там меньше, чем на минуту. И, и готово, ушло. Это мне понравилось. То есть там о-очень хорошо. Ну и, конечно, NotebookLM — это неплохое применение. Все-таки это, понятно, как pet project, наверное, кого-то в Google. Но это тоже неплохое применение уже. И, честно говоря, ну, как бы, да, пока ощущение, что foundational компании, они как бы не пробуют запускать продукты, они пробуют прототипы запускать. Вот они у них все какое-то-- они все работают сейчас прототипами, они все как будто стартап seed-стадии. Что-нибудь запустил, такой легковесный интерфейс-
Да.
Посмотреть. Будет работать. Никаких workflow, ничего нету, чисто интерфейс какой-то кинул, модельки соединил, попромптил и готово. Да. То есть у всех как будто бы фандинга там на три миллиона долларов такой seed-стартап, эээ, которому нужно просто, не знаю, по-получить тысячу пользователей. Ааа, ну, какой-то такой подход, да. То есть, к сожалению, не понимаю этого. Apple меня сильно разочаровал. Может, у вас есть-- может быть, у вас более позитивный опыт использования? Я вообще не понял. Apple Intelligence.
То есть-
Не, у меня нету точно позитивного опыта. Мало того, я хочу сказать, смотрите, я любитель Apple, иии я часто абсолютно про это говорю. С учетом количества своей техники и всего. У меня есть все же ощущение, что Apple с учетом их там команд и всего они сделают и выпустят что-то серьезное. Я надеюсь, они выпустят свою модель, и все закончат говорить, что Apple нет своей модели, у них будет своя модель. В то же время, Саша, ты прав. Например, они выпустили вот это Apple Intelligence, и она у меня раз в день или раз в два дня появляется так, но в момент, когда я не просил, я вообще не понимаю, что это такое и не понимаю, что оно хочет мне предложить. Я просто сижу там, эээ, сижу какой-то текст читаю, оно мне предлагает дурацкое применение, абсолютно стартаперское. Вот это когда со стартаперами они, значит, какую-то идею предложили часто, они тебе приходят, говорят: "Используй это". Ты говоришь: "Я хочу это использовать. Это мне не надо, оно мне только усложнит работу". Вот мне Apple вот этот ask, ask Siri, оно, оно выглядит очень странно. Там есть некоторые вещи, которые они улучшили. У меня там на iPhone восемьдесят тысяч фотографий. Они сделали всякие приколы, что там можно делать, не знаю, быстрые memories видео там или что-то еще. Но это микроштуки. Мало того, они работают по-настоящему криво. Ну, то есть они не работают классно. Это не система, которая проанализировала реально твой контент. Мало того, я готов открыть кучу своего контента. И это потому, что я знаю, что это даст мне возможность, ну, у-усилиться, улучшиться, да, быстрее двигаться. Пока для меня остается командная строка, увы, командная строка, значит, ChatGPT, в которой яяя, эээ, я, кстати, стал активно использовать o1 тоже в некоторых темах. И так как оно файлы туда грузить не надо, я с них копирую там текст этот огромный, даю ему, и он, значит, мне распознает. Ну, вот я использую какие-то плагины. Ну, понятно, что народ разные вещи пользуется. То есть Apple у меня нету, Саша, такого, чтооо... И еще они все. То есть если посмотреть весь, вот, мне кажется, последние полгода, очень огромное у всех за-- количество заявлений, у всех, на самом деле, у Google, от Google X AI до Apple, у всех просто огромное количество заявлений. Но нету-- ты привел-- прикольно, кстати, привел вот это сравнение, я о нем не думал, что, эээ, они, похоже, стали действовать как стартапы на фазе seed. Значит, показать свою идею. Да, вот как YC слушаешь, Y Combinator, двести компаний этих, что они за две минуты рассказывают.
Вот примерно похожая тема. Хм. Глава Apple вышел на демонстрацию, рассказал, что такая штука. Где?
Пока вы обсуждаете, я сидел, думал, а как же можно было бы использовать новый интерфейс как-- ну, новый способ взаимодействия Anthropic, который дали. Пока главное, что я придумал, это можно, например, на фриланс или на Upwork, эээ, давать этому боту выполнять задания за деньги. И там вопрос только потом в экономике становится, да? То есть деньги-
Да, да, да
Которые ты получаешь за выполненный заказ, они покрывают сожженные токены или нет. Но если покрывают, получается такая петля по зарабатыванию денег.
И смо-- и смотришь, что агент может сделать, когда у него задача тупо максимизировать прибыль. И там, на самом деле были позитивные результаты. Здесь я хотел немножко сделать segue, ааа, чтобы немножко закон-- мы тут по большим компаниям, в принципе, почти, почти по всем прошлись, кроме Microsoft. Может быть, сегодня хотел закончить именно Microsoft. Что мне у них как бы нравится в подходе, что они в Copilot вот только, по-моему, в течение последних двенадцати часов они объявили, что будут использовать все модели. И Anthropic, и Google. Это очень круто, конечно, это-
Серьезно, да?
Это теперь убивает нафиг все. Это убивает все стартапы. Все, больше стартапов, которые делают coding, не существует.
К сожалению. Ну потому что как? У тебя есть distribution, да? И у тебя, ну, как бы ты мог сказать: "Ой, я там вертикализация, я там, там все, там вертикальный стек под задачи и все такое". Но как бы, это как это? Ну, то есть, и это можно там сделать, сказать, что OpenAI не сфокусирован на кодинге. Что как бы правда, потому что Claude их выигрывает в кодинге. Но поставить против всех foundational моделей
В юзкейсе, который, очевидно, для Клода и для Гугла важен, точно важен. Это, это-- ну и они могут подключать и другие модели. Я уверен, если вдруг какой-то стартап разработает свою модель, они все равно подключат. Я уверен, Copilot договорится. Это очень серьезный шаг, который отрежет всех конкурентов. Это, не знаю, для меня это, ну, то есть, конечно, все ко-кодинг стартапов тоже не стало. И честно говоря, сейчас основные примеры того же Клода, вот этих, вот этого Клода, того, что он может работать, не только код писать, но может работать и в IDE, да, то есть он там может, ну, то есть это, это, на мой взгляд. Это, ну, это с-серьезный шаг.
Саш, ну ты говоришь, что у них стратегии тоже нету. Получается, что у них и стратегии нету, потому что Microsoft заявляла полгода назад одно, год назад другое, сейчас заявляет третье. То есть это говорит о том, что они все ищут тоже и тоже никогда не понимают,
куда идут.
Они ищут, да, они ищут. Видишь, вот видишь, что как бы интересно то, что да. То есть я ч-- я слышал, что там есть большие проблемы, ну, вот с OpenAI понятно, да? То есть, там, понятно, когда у тебя весь leadership уходит, стратегия тоже меняется и распределение людей между проектами. Sora не зарелизили, не зарелизилась и так далее. Sora уже не лучшая модель по evaluation, далеко не лучшая. Модель у китайцев, которая есть Kling, это считается по evaluation объективно лучше, чем Sora. В общем, это мы так немножко, видимо, все немножко ушли в сторону, но суть в том, что, ну, Microsoft играет там в свою игру, когда у них такая distribution и вот эта вот витиеватая структура, там подключение всех software вендоров, интеграции и так далее. То есть сейчас я-- то есть сейчас нету уже вот этого подхода, что вертикали, что можно вертикализироваться и победить. И я думаю, что те, кто говорят, что они сделают on-prem, там еще что-то там, не знаю, VPC, что это вот будет там суперприватно. Я думаю, что в эту игру Microsoft тоже будет очень сложно победить. Сейчас я максимально...
В каких направлениях, Саш, можешь вот для аудитории, чтобы было чуть понятнее, в каких направлениях смогут п-победить?
Я думаю, сейчас Microsoft непонятно где победить.
Ага.
Я думаю, это-
Непонятно, непонятно, ну, это же не во всем.
Ну, имеется в виду в кодинге. И сейчас я уже не понимаю, как их победить. То есть в кодинге у них огромная distribution, они владеют GitHub. GitLab, другая как бы альтернативная платформа, вроде в GenAI вообще ничего не делает. Сейчас как победить Microsoft в кодинге я не знаю. То есть то, что они убрали vendor lock на OpenAI и пользуются всеми моделями, это, на мой взгляд, титаническое просто изменение, которое как бы, я не знаю, которое... То есть понятно, что Open, что будут OpenAI, Anthropic, Meta, Google, китайские компании, которые тренируют свои модели. А, и если Microsoft подключает все самое лучшее, то конкуренция очень сильно растет, конечно.
Конкуренция очень-- в смысле планка для, планка для того, чтобы конкурировать с Microsoft, там сильно растет.
Да. Хотя, кстати, напомним, что огромное количество стартапов, особенно стартапов, которые финансировали, они были именно в кодинге. И сколько, сколько профинансировано в кодинге — это просто трындец.
Да, я бы. То есть я бы, если говорить про то, где конкурировать, то есть я бы, честно говоря, бы вот пошел. То есть там есть как бы шансы именно про то, чтобы покрывать четк-- жестко покрывать workflow, но workflow покрывать с интеграцией в такие очень сложные системы. Ну, например, для криэйтора, который хочет, я не знаю, не знаю, криэйтора, который хочет сделать свою, свою медиаимперию, да, например. То есть надо свой контент выкладывать, производить мобильное приложение, сайт, подкасты. Вот можно вот такую новую-
Вот можно вот такую новую медиаплатформу сделать. Там, да, да, там должны быть агенты, которые пишут приложение и сайт, но там очень это должно быть-- мне кажется, что это должно выходить за рамки непосредственно кодинга, должно и дизайн включать, и некоторые QA. А, то есть это, мне кажется, стало сильно сложнее сейчас теперь. То есть надо вот уже чисто на-- если, то есть стартап делает чисто что-то связанное с кодингом, то, мне кажется, Microsoft уже не победить.
Прикольно, очень интересно. Очень интересная концовка нашей-- сегодняшнего выпуска. Напишите, пожалуйста, в комментариях. Мне кажется, мы сегодня такую тему подняли по поводу вот игроков. Вы что думаете по поводу все же игроков? Куда кто будет идти? Мы обязательно все читаем, мы будем это вместе смотреть и вспоминать. И, эээ, кто победит? Самое главное, кто победит. Обязательно пишите комментарии, что вы думаете по поводу того, что Байден сделал. Это имеет значение с точки зрения меморандума. Увидимся ровно через неделю, в воскресенье. Нас здесь всегда четыре человека. Сегодня тридцатый выпуск, у нас тридцать выпусков, юбилейный. И мы без Тани, но ей, эээ, ей как возможно, и все окей. До новых встреч! Технологические новости, инсайты из Кремниевой долины по всему миру. Ребят, всем пока. Всем большое спасибо.