Кстати, думаете у российского ИИ проблемы? Да вы на Google посмотрите. Gemeni 3.5 Pro уже никто не ждет, похоже ее решили не выпускать и начали тренить 4.0 Pro. Пока на замену Flash-версии выкатывают чтобы окончательно не списали с повестки дня. Все изменения — только кодинг и агенты, на прочее забили наглухо.
А вообще Google похоже решила всерьез подъесть бизнес у NVIDIA. Та надеялась что пока новички пилят чипы по 2-3 года, она выпустит 2-3 поколения ИИ-ускорителей. Но не учла что Google делает ASIC-и уже 13 лет, и опыта набралась достаточно. В итоге Google собралась делать по чипу каждые ПОЛГОДА.
При этом вряд ли она будет их продавать, зато уже сейчас вовсю сдает свои серверные мощности, тем самым сильно подрывая монополию CUDA. NVIDIA уже ноет, типа — ну ладно, делайте свои чипы уродские, но давайте я их в свои сервера буду встраивать — они классные, там интерконнет крутой, корпусировка и вообще инфраструктура! Может и наноет, так-то предложение дельное.
«ИТАК» - канал из категории «Технологии», подключенный к сервису кросспостинга MaxGate. Публикации канала синхронизируются между Telegram и мессенджером MAX, а на этой странице собраны ссылки на обе версии канала.
Сейчас у канала 7 462 подписчика суммарно в Telegram и MAX. За последние 29 дней в истории MaxGate учтено 23 публикаций, поэтому перед подпиской можно оценить не только размер аудитории, но и регулярность обновлений.
Чтобы подписаться, используйте кнопки «Открыть в MAX» и «Открыть в Telegram» в верхней части страницы. У отдельных постов ссылка может быть доступна в обоих мессенджерах или только в одном из них, если MaxGate получил такой URL из истории обработки.
Итак, российский искусственный интеллект. Казалось бы: нет его и все тут. А то что есть — не интеллект, а так, профанация и попил бюджета. Однако чем дальше, тем больше становится ясно: ИИ это не про мощь, а про данные. И в этом плане Россия далеко не аутсайдер.
Например, у нас уже работает платформа анализа снимков «МосМедИИ», в базе данных которой есть 16 млн исследований. На Западе также пытаются собрать такие базы, только у них это сложно: есть законы о медтайне, нужно согласие пациентов, разные форматы, плюс коммерческие интересы — каждый хочет на данных заработать. В итоге все попытки создать медицинский ИИ сталкиваются с невероятным сопротивлением системы. Британия и Германия до сих пор ее не преодолели, в США что-то есть, но стоит дороже анализов у человека. А у нас — бесплатно.
И такая логика работает не только в медицине. Транспорт, образование, городское хозяйство - везде, где государство оказывает массовую услугу, у него по ходу дела накапливаются уникальные датасеты, которого нет ни у кого. И это существенный бонус для обучения специализированных ИИ.
Далее, может кто помнит недавний материал про то что в России все очень неплохо с фундаментальной наукой? Вот вам свежий пример: российские математики придумали модель, которая заняла первое место на лидерборде ARC Prize этого года. Там соревнуются инновации, приближающие искусственный интеллект к моменту когда он сравняется с человеческим.
Небольшой стартап Mostik созданный 4 месяца назад придумал как повысить эффективность моделей в 2,5 раза практически на пустом месте. Как это работает: ИИ формируя токен использует кучу информации в виде скрытых векторов (порядка пары мегабайт), которые в итоге превращаются примерно в 17 бит самого токена. И если готовый токен — это аналог сознания модели, то набор векторов для его создания — это по сути «подсознание» модели, и сейчас эта информация просто сливается впустую.
И вот эти товарищи придумали как ее можно использовать: создали «мостик» через который модели могут обмениваться своим подсознанием друг с другом. Они обучили небольшой модуль-переводчик, который передает скрытые состояния от одной модели к другой. При этом модели могут быть из разных семейств, их веса не меняются, и совсем никакого текста между ними не проходит.
Зачем это нужно? Например, берем большую и умную модель, а также мелкую и глупую. Большая модель читает текст и передает свое подсознание маленькой, которая уже генерирует из него токены. Итог: дешевая модель умнеет в два раза, а эффективность растет в 2,5 раза если сравнивать с моделью экивалетного уровня. Профит!
Ну и еще есть информация, которой я правда не доверяю (есть там нестыковки), однако звучит интересно. В мае Путин на встрече с Си поддержал китайскую инициативу по созданию Всемирной организации сотрудничества в области искусственного интеллекта. Летом мы стали одним из учредителей этой организации, как и еще 28 государств. И некоторые эксперты (которым я не слишком доверяю, повторюсь) делают вывод что это практически вотум недоверия Сберу с его Гигачатом, просравшему все полимеры, и выдача карт-бланша Яндекса с его Алисой, созданной по сути на базе Qwen.
Тем не менее доводы в пользу этой теории интересные: летом правительство включило Алису в список обязательных программ для установки на смартфоны, при этом сберовскую Марусю оттуда исключили. А 2 сентября начали говорить о предоставлении Алисе доступа к смартфону на уровне встроенных систем Google и Apple. Ну то есть явно какая-то движуха идет, но я честно в этом не очень разбираюсь чтобы далеко идущие выводы делать, и вам не советую. «Темна вода во облацех» (с)