К содержанию
OpenAI · Google · Y CombinatorВыпуск 001 · 12 апреля 2024 · 48:33

США против Китая, Google против Microsoft, Anthropic против ChatGPT: что происходит в Hi-Tech мире

Главный вопрос

Кто на самом деле контролирует гонку ИИ: владельцы моделей, чипов, инфраструктуры или доступа к пользователю?

Результат для читателя

Разобраться, как контроль над ИИ распределён между моделями, чипами, кадрами, облаком и доступом к пользователю — и оценивать игроков по всей цепочке, а не по одному бенчмарку.

Главные линии разговора

На что обратить внимание

1Сопоставьте блоки «Технологические новости, стартапы» и «Y Combinator и тренды стартапов»: они дают разные критерии оценки одной темы.
2Проверьте вывод из блока «Anthropic круче ChatGPT?» на собственном сценарии — что действительно меняется в процессе, а что остаётся обещанием.
3До выбора продукта или подхода зафиксируйте ограничение, раскрытое в блоке «Сферы применения голосовых аватаров».
4Определите владельца результата и метрику качества для ситуации, описанной в блоке «Борьба США против Китая в сфере ИИ: NVIDIA против Huawei».
На что смотреть после выпуска
Следите за действиями Anthropic и Google, которые подтверждают или опровергают ключевые тезисы выпуска.
Сравнивайте новые запуски и изменения условий с блоком «Anthropic круче ChatGPT?»: поменялись ли доступ, качество, цена или ограничения.
Проверяйте, становится ли сценарий из блока «Борьба США против Китая в сфере ИИ: NVIDIA против Huawei» повторяемой практикой, а не разовой демонстрацией.
Кому особенно полезно
руководителямпользователям ИИпродуктовым командаминвесторампредпринимателямстратегам

Ключевые тезисы и выводы

00:00Мы видим голосового аватара, новый чат или очередную демонстрацию, а за этим стоят зарплаты инженеров в

Сцена «Самая дорогая часть новой гонки ИИ почти не видна обычному пользователю» подводит к рабочему выводу: за витриной демонстраций идёт борьба за инженеров с зарплатами в миллионы долларов, планы привлечь триллионы на инфраструктуру и немногих людей, способных строить такие системы, — поэтому игроков стоит оценивать по контролю над кадрами, вычислениями и каналами доставки продукта, а не по красоте очередного чата.

01:21Почему одного анонса недостаточно: цифровые аватары - что происходит в венчурных фондах

Сцена «Цифровые аватары - что происходит в венчурных фондах США? О разработке Google» подводит к рабочему выводу: на демо-дне Y Combinator две компании уже питчились через аватаров, и в фонде всерьёз спорили, человек это говорит или нет; при этом влогер Google — демонстрация уровня Google Research, а не продукт, тогда как Synthesia и HeyGen с выручкой больше 20 млн долларов в год показывают, что спрос на технологию реален.

05:00Рынок проверяет это применением: фейковые голоса - находка для мошенников? К чему

Тема «Фейковые голоса - находка для мошенников? К чему это может привести» становится понятнее, если учитывать следующее: тот же инструмент, что озвучивает книги, становится готовой машиной для мошенничества и политических манипуляций, поэтому OpenAI сознательно ограничивала доступ к технологии голоса: пока подделка делается быстро и дёшево, общество ещё не научилось отличать её от живого человека.

11:03Граница пользы и ограничения: сферы применения голосовых аватаров

Для решения, обсуждаемого в сцене «Сферы применения голосовых аватаров», важен критерий: рядом с озвучкой сказок родительским голосом, поддержкой людей с нарушенной речью и переводом изданий на любой язык стоит ограничение: по выходам мощной модели можно за десятки тысяч примеров обучить сопоставимую копию, поэтому закрытость Google или OpenAI сама по себе злоупотреблений не останавливает.

14:42Кто отвечает за результат: борьба США против Китая в сфере ИИ: NVIDIA

Для сцены «Борьба США против Китая в сфере ИИ: NVIDIA против Huawei» решающим становится следующее: NVIDIA проектирует чипы, TSMC производит их на Тайване, Китай развивает Huawei Ascend, а Google, Intel и Qualcomm ищут, как снизить зависимость от одного поставщика, — на этом уровне экспортная мера или производственное ограничение значит больше, чем очередное улучшение алгоритма.

21:52Что меняется в реальной работе: эмоциональная сторона ИИ: как скоро искусственный интеллект перестанет

Практический смысл темы «Эмоциональная сторона ИИ: как скоро искусственный интеллект перестанет быть «искусственным»» в том, что голос уже даёт рабочие сценарии — аудиокниги голосом любимого актёра, наушники с синхронным переводом в реальном времени, — но передачу эмоций и внимания, самого важного для детей и близких, участники считают пока недостижимой, а возможно, и утопичной.

26:33Параллельно Y Combinator показывает, куда идёт предпринимательская энергия

Оценивать тему «Y Combinator и тренды стартапов» нужно с учётом того, что в акселераторе всё больше компаний вокруг ИИ, но громкое слово в презентации ещё не создаёт рынок: тот же Devin оценивается не по демонстрации, а по тому, насколько надёжно он выполняет работу и сколько контроля остаётся человеку.

33:40Главная картина здесь простая: OpenAI, Google, Anthropic, Microsoft и китайские игроки конкурируют сразу на нескольких этажах — модели, чипы, облако, данные, продукты и кадры

Рабочий вывод из сцены «Anthropic круче ChatGPT?» состоит в том, что у Anthropic есть окно в три–шесть месяцев до вероятного релиза GPT-5, а Amazon, реализовав опцион и доложив денег, подтвердил ставку на компанию: облачному лидеру без собственной сильной модели это партнёрство нужно стратегически.

О чём этот выпуск

Гонка ИИ начинается не с красивого чат-бота, а с людей, чипов, денег и доступа к инфраструктуре. Пока OpenAI и Google показывают голосовые аватары, NVIDIA и Huawei борются за вычислительную основу рынка, а Y Combinator проверяет, какие идеи действительно превращаются в бизнес.

Самая дорогая часть новой гонки ИИ почти не видна обычному пользователю. Мы видим голосового аватара, новый чат или очередную демонстрацию, а за этим стоят зарплаты инженеров в миллионы долларов, планы привлечь триллионы на инфраструктуру и борьба за тех, кто вообще способен строить такие системы.

Поэтому вопрос уже не в том, какая модель сегодня ответила красивее. Вопрос в том, кто контролирует людей, вычисления и каналы доставки продукта.

Голосовые аватары хорошо показывают двойственность рынка. С одной стороны, HeyGen, Synthesia и разработки Google открывают нормальные практические сценарии: озвучка, обучение, персональные сообщения, детские книги голосом родителей.

С другой — тот же инструмент становится готовой машиной для мошенничества и политических манипуляций. OpenAI не случайно ограничивала доступ к технологии голоса: если подделку можно сделать быстро и дёшево, общество ещё должно научиться отличать её от человека.

На уровне инфраструктуры конфликт ещё жёстче. NVIDIA проектирует чипы, TSMC производит их на Тайване, Китай развивает Huawei Ascend, а Google, Intel и Qualcomm ищут способы снизить зависимость от одного поставщика. Здесь любая экспортная мера или производственное ограничение может оказаться важнее очередного улучшения алгоритма.

У страны без доступа к современным чипам просто не будет той же скорости развития моделей.

Параллельно Y Combinator показывает, куда идёт предпринимательская энергия. В акселераторе появляется всё больше компаний вокруг ИИ, но громкое слово в презентации ещё не создаёт рынок.

Тот же Devin заставляет обсуждать конец профессии программиста, хотя реальная ценность такого продукта определяется не демонстрацией, а тем, насколько надёжно он выполняет работу и сколько контроля всё равно остаётся человеку.

Главная картина здесь простая: OpenAI, Google, Anthropic, Microsoft и китайские игроки конкурируют сразу на нескольких этажах — модели, чипы, облако, данные, продукты и кадры. Победит не тот, кто один раз занял первое место в тесте, а тот, кто сможет связать все эти уровни в работающую систему и сделать её доступной обычным людям.

Одного первого места в тесте недостаточно: преимущество получает игрок, который связывает модели, вычисления, данные, продукт и дистрибуцию в работающую систему.

Расшифровка выпуска

Голосовая связка применена к 47 сегментам: 37 определено, 6 содержат несколько определённых участников, 2 вероятных, 2 остаются без окончательной идентификации. Неподтверждённые голоса обозначены как «Участник дискуссии», фрагменты с несколькими подтверждёнными участниками — как «Микс».

Загрузка…