США против Китая, Google против Microsoft, Anthropic против ChatGPT: что происходит в Hi-Tech мире
Кто на самом деле контролирует гонку ИИ: владельцы моделей, чипов, инфраструктуры или доступа к пользователю?
Разобраться, как контроль над ИИ распределён между моделями, чипами, кадрами, облаком и доступом к пользователю — и оценивать игроков по всей цепочке, а не по одному бенчмарку.
На что обратить внимание
Ключевые тезисы и выводы
Сцена «Самая дорогая часть новой гонки ИИ почти не видна обычному пользователю» подводит к рабочему выводу: за витриной демонстраций идёт борьба за инженеров с зарплатами в миллионы долларов, планы привлечь триллионы на инфраструктуру и немногих людей, способных строить такие системы, — поэтому игроков стоит оценивать по контролю над кадрами, вычислениями и каналами доставки продукта, а не по красоте очередного чата.
Сцена «Цифровые аватары - что происходит в венчурных фондах США? О разработке Google» подводит к рабочему выводу: на демо-дне Y Combinator две компании уже питчились через аватаров, и в фонде всерьёз спорили, человек это говорит или нет; при этом влогер Google — демонстрация уровня Google Research, а не продукт, тогда как Synthesia и HeyGen с выручкой больше 20 млн долларов в год показывают, что спрос на технологию реален.
Тема «Фейковые голоса - находка для мошенников? К чему это может привести» становится понятнее, если учитывать следующее: тот же инструмент, что озвучивает книги, становится готовой машиной для мошенничества и политических манипуляций, поэтому OpenAI сознательно ограничивала доступ к технологии голоса: пока подделка делается быстро и дёшево, общество ещё не научилось отличать её от живого человека.
Для решения, обсуждаемого в сцене «Сферы применения голосовых аватаров», важен критерий: рядом с озвучкой сказок родительским голосом, поддержкой людей с нарушенной речью и переводом изданий на любой язык стоит ограничение: по выходам мощной модели можно за десятки тысяч примеров обучить сопоставимую копию, поэтому закрытость Google или OpenAI сама по себе злоупотреблений не останавливает.
Для сцены «Борьба США против Китая в сфере ИИ: NVIDIA против Huawei» решающим становится следующее: NVIDIA проектирует чипы, TSMC производит их на Тайване, Китай развивает Huawei Ascend, а Google, Intel и Qualcomm ищут, как снизить зависимость от одного поставщика, — на этом уровне экспортная мера или производственное ограничение значит больше, чем очередное улучшение алгоритма.
Практический смысл темы «Эмоциональная сторона ИИ: как скоро искусственный интеллект перестанет быть «искусственным»» в том, что голос уже даёт рабочие сценарии — аудиокниги голосом любимого актёра, наушники с синхронным переводом в реальном времени, — но передачу эмоций и внимания, самого важного для детей и близких, участники считают пока недостижимой, а возможно, и утопичной.
Оценивать тему «Y Combinator и тренды стартапов» нужно с учётом того, что в акселераторе всё больше компаний вокруг ИИ, но громкое слово в презентации ещё не создаёт рынок: тот же Devin оценивается не по демонстрации, а по тому, насколько надёжно он выполняет работу и сколько контроля остаётся человеку.
Рабочий вывод из сцены «Anthropic круче ChatGPT?» состоит в том, что у Anthropic есть окно в три–шесть месяцев до вероятного релиза GPT-5, а Amazon, реализовав опцион и доложив денег, подтвердил ставку на компанию: облачному лидеру без собственной сильной модели это партнёрство нужно стратегически.
О чём этот выпуск
Гонка ИИ начинается не с красивого чат-бота, а с людей, чипов, денег и доступа к инфраструктуре. Пока OpenAI и Google показывают голосовые аватары, NVIDIA и Huawei борются за вычислительную основу рынка, а Y Combinator проверяет, какие идеи действительно превращаются в бизнес.
Самая дорогая часть новой гонки ИИ почти не видна обычному пользователю. Мы видим голосового аватара, новый чат или очередную демонстрацию, а за этим стоят зарплаты инженеров в миллионы долларов, планы привлечь триллионы на инфраструктуру и борьба за тех, кто вообще способен строить такие системы.
Поэтому вопрос уже не в том, какая модель сегодня ответила красивее. Вопрос в том, кто контролирует людей, вычисления и каналы доставки продукта.
Голосовые аватары хорошо показывают двойственность рынка. С одной стороны, HeyGen, Synthesia и разработки Google открывают нормальные практические сценарии: озвучка, обучение, персональные сообщения, детские книги голосом родителей.
С другой — тот же инструмент становится готовой машиной для мошенничества и политических манипуляций. OpenAI не случайно ограничивала доступ к технологии голоса: если подделку можно сделать быстро и дёшево, общество ещё должно научиться отличать её от человека.
На уровне инфраструктуры конфликт ещё жёстче. NVIDIA проектирует чипы, TSMC производит их на Тайване, Китай развивает Huawei Ascend, а Google, Intel и Qualcomm ищут способы снизить зависимость от одного поставщика. Здесь любая экспортная мера или производственное ограничение может оказаться важнее очередного улучшения алгоритма.
У страны без доступа к современным чипам просто не будет той же скорости развития моделей.
Параллельно Y Combinator показывает, куда идёт предпринимательская энергия. В акселераторе появляется всё больше компаний вокруг ИИ, но громкое слово в презентации ещё не создаёт рынок.
Тот же Devin заставляет обсуждать конец профессии программиста, хотя реальная ценность такого продукта определяется не демонстрацией, а тем, насколько надёжно он выполняет работу и сколько контроля всё равно остаётся человеку.
Главная картина здесь простая: OpenAI, Google, Anthropic, Microsoft и китайские игроки конкурируют сразу на нескольких этажах — модели, чипы, облако, данные, продукты и кадры. Победит не тот, кто один раз занял первое место в тесте, а тот, кто сможет связать все эти уровни в работающую систему и сделать её доступной обычным людям.
Одного первого места в тесте недостаточно: преимущество получает игрок, который связывает модели, вычисления, данные, продукт и дистрибуцию в работающую систему.
Расшифровка выпуска
Голосовая связка применена к 47 сегментам: 37 определено, 6 содержат несколько определённых участников, 2 вероятных, 2 остаются без окончательной идентификации. Неподтверждённые голоса обозначены как «Участник дискуссии», фрагменты с несколькими подтверждёнными участниками — как «Микс».
Загрузка…