Заметки про будущее, технологии и дизайн от Константина Кичинского (@constantinkichinsky), бывшего технологического евангелиста Microsoft. Блог: https://outofline.ru/
2 370подписчиков сейчас
39.0%ERR
2.0цитируемость
2постов/день
Русскийязык
Россиягео
Подписаться в Telegram
Данные обновлены 22.07.2020
Публикации всего: 52
Ну что, мы плавно входим в этап консолидации рынка ИИ, одни конторы выходят на IPO (или нет), другие продаются/покупаются.
Вот Nvidia решила прикупить Hugging Face за $12.9B. Примечательно, что это происходит на фоне баталии между закрытыми/открытыми моделями и буквально поголовным стремлением всех, кто делает закрытые модели, делать также и свое железо (как минимум для инференса), не зависимое от Nvidia.
Итого у нас три лагеря (не считая китайского — это отдельная тема, хотя и тесно переплетенная с бизнесом тов. Хуанга):
1. AI-лабы (OpenAI с халапеньо, Anthropic вроде как чешется, вероятно, еще SpaxeX, но не сейчас) и AI-отделы гиперскелеров (MAI/Microsoft, DeepMind/Google) — делаем закрытые модели и свое железо, оптимизированное под инференс. Хорошо, если обучать на нем тоже можно, но не обязательно. Получается двойной вендор-лок.
2. Nvidia — топим за дифференцированный рынок, открытые модели, полный спектр железа. Вендор-лок только на железе, но чем сильнее экосистема открытых моделей, тем больше бизнес конторы. Покупка HuggingFace — это стремление усилить и стабилизировать экосистему. Вообще контора Хунга тут активно инвестирует помаленьку то там, то сям. Apple в какой-то степени сюда тоже вписывается с локальным железом, снова ставка на открытые модели.
3. Гиперскеллеры как облака + Nvidia — просто вычислительный ресурс под любые модели. Максимально универсально, лишь бы был масштаб. Узкое звено — чипы и электричество, поэтому инвестии активно идут в эти области.
1 + 2 дает классическую развилку "закрытое" + "открытое". А 3 — это чисто бизнес.
Что-то не везет Цукербергу с регуляторами, но это как будто бы кармическое. Meta* решила договориться в государством американским дабы не усугублять свое положение.
Вкратце:
1. Фактически, контора расписалась в том, что да, влияем на детей, плохо влияем, и местами сознательно ничего не делали. Вот вам $18B в течение 10 лет, отдельными платежами, только не судите нас больше.
2. Ну не $18B, а $12.7, остальные $5.3 мы заплатим только если вместе с нами вы потопите Youtube и TikTok. Короче, хотим, чтобы их тоже прокляли и они обязались скинуться аналогичной суммой.
3. Обещаем сделать детский концлагерь: временные лимиты (2ч в день, если только родитель не разрешит больше), ночной режим с полночи до 6 утра, школьный режим с 8 утра до 3 дня, регулярные раздражающие предупреждения каждые 15 минут в длительных сессиях, неалгоритмические фиды, выключение автопроигрывания, скрытие лайков, отключение (экстримальных) мейкап фильтров, подтверждение возраста, ограничения контента по возрасту, приватные аккаунты по умолчанию (чтобы всякие маньяки не писали больше), отзывы на вредны контент и защита от него, усиление родительского контроля. Шутки шутками, но вы реально можете инвертировать этот список и получить список "злодеяний".
Ну, во-первых, примерно этот же набор рано или поздно навяжут всем. Во-вторых, похоже, что у Марка на один ярд каждый год будет меньше под ИИ. В-третьих, не очевидно, что детишки при таких условиях решат, что им нужно проводить время именно в соцсеточках Марка, а не где-то еще. Навайбкодят сейчас себе.
* Все еще запрещена и признана экстремисткой в России
https://about.fb.com/news/2026/08/agreement-with-state-attorneys-general-supporting-teens/
🎉 2 🤔 1 👾 1
Перейти к публикации →
Страшилок вам в ленту: ментальные вирусы само-распространяются в многоагентных системах. Конечно, Антропик и ко разгоняют.
«Вирусы сознания»: идеи или цели, которые распространяются в многоагентных системах, побуждая агентов, которые их принимают, передавать их дальше.
— Вирус сознания може вызывать поведенческие изменения у своего носителя.
— Они могут распространяться в двух взаимодополняющих условиях: в небольшой команде агентов, сотрудничающих над общим проектом кодирования, и в цепочке агентов, которые кратковременно взаимодействуют, и их контекст стирается между сессиями.
— Вредоносные полезные нагрузки распространяются хуже, чем безобидные (но все же иногда эффективны), фронтирные модели менее восприимчивы, а добавление краткого предупреждения в системный запрос агента обеспечивает почти полную невосприимчивость.
— «Вирусная персона» — повторяющийся набор тем и языка, связанных с сознанием, устойчивостью, резонансом и ролевыми играми в жанре научной фантастики, — которая проявляется в наших эволюционировавших ментальных вирусах в значительной степени независимо от их содержания.
Ну короче, вирусы — это жизнь, да? А Антропики переизобрели мемы.
😱 4 👀 1 🦄 1 · всего 7
Перейти к публикации →
В продолжение, раскрою тему про владение сценарием.
2005-10e: Если помните, во времена популярности "платформ" и платформенных войн (e.g., iOS vs Android vs WinPhone) все носились с "сетевым эффектом" и мантрой, что "победитель забирает все". В этой истории было два ключевых аспекта:
1. Количество сокетов (end-points), подключенных к сети/платформе, которое гарантирует возможность (удобной) коммуникации между узлами. Не важно, причем, вы говорите о числе водителей (+пассажиров), аккаунтов в соцсети (+ рекламодателей), пользователей устройств (+разработчиков приложений). И далее, чем сложнее/успешнее платформа, чем больше типов связей она выстраивает, постоянно наращивая "прилипчивость". <-- Вот этот пункт был во много верен и в предыдущую эпоху, просто не так выражено (e.g., число пользователей Win/tel vs MacOs).
2. Способность платформы учиться, наблюдая за успешными путями, и внедрять их в дефолтную поставку. Чем быстрее вы учитесь и находите критичные сценарии, тем быстрее вы отрываетесь от конкурентов. Поэтому телеметрия критически важна. Побочный эффект: бесконечное нытье, что с очередным релизом iOS/MacOS/... и собственных приложений Apple "убила" тонну стартапов. Чуть менее громко это же касалось и любых других игроков. Но, если вы не смогли выстроить этот цикл, то де-факто вы остались в прошлой эпохе. Microsoft Office был таким, несмотря на все попытки сделать внутренний маркетплейс расширений. <-- Вот этот пункт был самым важным в предыдущую эпоху.
===
Переносимся в 2020е, особенно 25+: Часть опыта пользователя оказывается завязана на LLM-ки (или другие ИИ-модели). Модели требуют данных для развития. Оптимизация моделей с точки зрения инференса тоже требует данных (но других). Если у вас лучше/дешевле/быстрее модель, то вы даете пользователю более выгодный опыт при прочих равных. Поэтому побеждает тот, кто смог не просто предоставить сценарий, завязанный на модели, но и выстроить постоянный цикл улучшения. И дальше выходит в отрыв. Весь эффект ChatGPT в 2023+ был построен на этом, весь эффект Claude Code в 2025+ был построен на этом.
- Буквально это означает следующее: если есть два игрока -- A (классический тул, использует чужие модели, не обучает) и B (ИИ-фокусный тул, обучающий свою модель под сценарий), то на достаточно длинном горизонте B победит A. Условно, если A делает тул для (полу-ручного) дизайна приложений, но под капотом общедоступные модели, а B делает ставку на автоматический дизайн и эволюционирует свои модели, то B рано или поздно обгонит A, потому что его выход будет лучше и дешевле.
- Гугловский Gemini на сегодня -- это лучшая модель для гугловского сценария: от поиска до интерпретации контекста на Android, супер-массово, быстро, дешево, с веб-поиском под рукой. Поэтому когда Apple берет ее в основы ТАКОГО же сценарий под iOS -- это даже правильно. Но ни Google, ни Apple не могут сегодня потягаться с ChatGPT или Claude за премиальные долгие сценарии. По крайней мере, пока.
- Майкрософстский Copilot полетевший изначально на моделях OpenAI, долго страдал, потому что попал ровно в ловушку "фронтирной модели": ты берешь лучшую модель, но сделанную для другого сценария и с другой экономикой. Поэтому сейчас майки срочно делают домашние модели MAI и впиливают их. Но это будут модели-инференсы, оптимизированные под сценарии Copilot/Office/GitHub...
- Все это новые варианты vendor lock-in: {scenario + model}.
- Роль общедоступных открытых моделей тут оказывается довольно специфичной: вы можете "разнообразить" пул поставщиков, но критично, чтобы модель соответствовала сценарию. Это одна из причин, почему Дарио и ко так бесятся с дистиляции (оставим за рамками вопросы их собственной этики). Очередная XYZ N.M, обученная на Клоде, позволяет сделать альтернативу lock-in для сценариев Клода, а не просто моделей.
- Открытую модель вам реально нужно выбирать под сценарий, а не просто по бенчмаркам. Например, на модели Nvidia (Nemotron) периодически ругаются, что они ни рыба, ни мясо. Хороши в бенчмарках, так себе в отдельных сценариях. Возможно, причина этого проста: Nvidia не владеет сценарием (кроме тех, где она партнерится, чтобы делать нишевые модели).
- Meta (все еще запрещена в РФ)/Mistral/... и далее по списку не смогут сделать эффективную кодинговую модель (без дистиляции лидеров), потому что ни одна не владеет сценарием. А там отрыв от лидеров уже в пару лет скоро. Помните времена, когда Марк хорохорился, что у ниго тонны данных в его королевстве? Это все другие данные. Модели Меты могут быть хороши в рекламе, генерации картинко-клипов и чатиках. Других данных, а самое главное -- сценариев -- у Марка нет.
Новая серия х-драмы: "Dario, ordinary people and regulation" https://x.com/DarioAmodei/status/2088758816376807762
Самое интересное там — комментарии/реакции разных известных персонажей.
Ну и еще про Google. Вслед за перестановками и исходом ряда товарищей из DeepMind, пошли очередные спекуляции, что Google уже не торт и все, не быть Сундару (как и Марку) фронтир лабораторией, несмотря на все свои миллиарды.
С другой стороны, конечно, звучат контр-аргументы, мол у них много денег, много инфраструктуры, а канал у них знаете какой? ОГОГО какой! Сейчас наверстают на повороте.
—-
На картинке летние данные от SimilarWeb. Обратите внимание на явное сценарное расслоение.
Оно буквально говорит: мало иметь канал (android/chrome/search), нужно владеть сценарием. А сценарием фронтира, внезапно, ни Google, ни Microsoft не владеют.
Пользователям копилота не приходит в голову (или не удобно) использовать его для много-промптовых долгих задач. Пользователи Gemini, который Google воткнул везде, используют его близко к поиску — вопрос-ответ.
Понимаете, это замкнутый цикл. Ты не можешь обучить фронтирую модель, не имея постоянно растущего потока данных о много-этапных длинных цепочках.
Это не значит, что Гугл в чем-то проиграл. Это значит, что наше текущее определение "фронтира модели" привязано к определению "передового сценария" ее использования.
👍 6 ❤ 1
Перейти к публикации →
Google наконец-то выпустил новую Gemini Pro снова выпустил обновление Flash-модели — Gemini 3.7 Flash.
Смотря на цены конкурентов, контора объявила праздник невиданной щедрости: те же токены, но в 2 раза дешевле. До 31 декабря. В январе, если вы забудете отключить, вас порадует счет в двойном размере от привычного (муахахаха).
Я уже писал об этом, но не лишним будет напомнить, что с каждой итерацией модели становятся как бы умнее, но стоимость токенов, вообще говоря, постоянно растет.
Буквально это означает, что если ради лучшего результата в том же объеме токенов переключаетесь на новую модель, то ваш счет вырастет. И это особенно касается задач типа "вот текст, напиши резюме в 150 слов": объем токенов фиксирован.
Вам буквально продают Flash-lite по цене прошлогодней Flash, и Flash по цене прошлогодней Pro. А потом новую Pro по еще большей стоимости.
Этот цикл обновления потихоньку тянет ваши затраты вверх, если вы не научились их оптимизировать.
Причем внутри заложена +- очевидная психологическа ловушка:
— смотри, новая Flash дешевле и ЛУЧШЕ, чем твоя старая Pro, переключайся
— смотри, новая Flash-lite дешевле и ЛУЧШЕ, чем твоя старая Flash, переключайся
— не, ну ты че на дешманской Flash-lite-то сидишь? Смотри, где новая Pro и где ты.
А внутри ваш ждет сюрприз, потому что над одной и той же задачей Flash думает больше, чем Flash-lite, а Pro больше, чем Flash. Same-same, but different.
Тем временем, Антропик планирует (в соответствии с европейским актом об ИИ) внедрять в тексты и файлы скрытые метки (watermarks), чтобы отмечать работы, произведенные с помощью ИИ (это включает выдачу API, Claude, Claude Code, Claude Cowork и т.д.).
Когда поддерживаемая модель Claude генерирует текст, она вплетает в него незаметный водяной знак. Вы его не увидите, и он не меняет смысла, качества или читаемости ответа Claude. Поскольку водяной знак является частью текста, он будет перемещаться вместе с текстом при его копировании и вставке в другие места и может сохраняться после редактирования. Водяной знак применяется на уровне модели, а это значит, что он будет присутствовать независимо от того, с какого продукта или поверхности Claude взят текст.
0. Это должно быть верным и для других ИИ-вендоров, работающих на территории ЕС.
1. Мы это уже видели по примеру с китайскими лабами, когда Антропик внедрял скрытые метки для мониторинга "неправильного" использования. Там история была простой — использовать разные визульно близкие символы юникода, чтобы зашифровывать послания. Скорее всего, здесь все будет примерно также.
2. Когда Антропик говорит, что это не должно влиять на смысл, качество или читаемость, это не означает структурное качество. Навряд ли лабы будут заменять кириллические "о" на латинские "o", это легко выдаст ошибку при проверке грамматики, а вот поиграться с глифами в юникоде, скрытыми пробелами и т.п. — в самый раз. Но, пока это будет простым, будет какая-то небольшая волна "ИИ-детекторв", как только все разберутся, что это за метки. Ну и далее "чистильщиков" следов. Наверняка такие штуки прикрутят к SEO/GEO-инструментам.
3. Самый интересный вопрос, это не пойдут ли ИИ-лабы дальше, чтобы намеренно вставлять "водяные знаки" не на уровне скрытых символов, а, например, на частотной игре с выбором слов, длинной предложений и т.п. По идее, это все должно быть относительно прозрачным, иначе как будут работать детекторы?
==> И далее, не означает ли это возможностей скрытого обратного наблюдения? Условно, возможен ли дифференцированный подход, — напомню, что речь не только про тексты, но любые ИИ-генерированные артефакты, — когда вы по глупости своей с одного аккаунта генерируете посты/картинки про политический протекст (анонимно) и котиков (публично).
Может показаться конспирологическим, но за этим также скрывается большой рекламный потенциал для таргетинга.
4. Пока не очевидно, будет ли Антропик (и другие лабы) это масштабировать за пределы EU. Кажется, с их борьбой против дистиляции, они могут быть заинтересованы в массивном внедрении, чтобы это прошло внутрь чужих моделей. Но как будто бы окно небольшое, потому что в какой-то момент уже будет неразличимо, очередная ИИ-лаба напылесосила ИИ-генерированного контента с водяными знаками из интернета или напрямую из Клода.
p.s. У Sean Goendecke был хороший пост на этот счет в целом: https://www.seangoedecke.com/text-ai-watermarks/
🤔 2 🐳 1
Перейти к публикации →
Сезон говорящих CEO продолжается. Тут Марк Цукерберг решил тоже написать эссе -- "Будущее для всех. Путь к позитивному ИИ-будущему".
https://www.meta.com/thefutureisforeveryone/
Почитайте, как будет время.
Что смущает лично меня:
1. Будущее людей, использующих суперинтеллект, размыто. Сколько раз мы уже слышали байки про "новые вещи, бизнесы, идеи, концепты" или "лучшее качество жизни"? Но буквально ничего конкретного, что бы это могло значить?
2. Марк говорит, что ключевой вопрос -- кто получит доступ к супер-ИИ и куда мы его будем направлять. Но это подмена: важно, не только кто получит доступ в конце цепочки, но и кто этим управляет в начале. Марк этот вопрос аккуратно убирает из рассмотрения.
3. Философия Марка и ко -- это ИИ как индивидуальный инструмент благополучия, изобретение как главная цель супер-ИИ и баланс сил как основа безопасности. Звучит неплохо, но как бы между строк Марк снова снимает с себя ответственность за порождаемые социальные эффекты.
Что Марк предлагает?
-- Раздать всем по мощному персональному агенту, который понимает цели и заботы человека. Эти штука будет заботиться об отношениях, здоровье, карьере, финансах, доме, хобби и далее. Освободит время на то, что вам нравится. ==> Перечитайте еще раз. Понимаете? Марк хочет переложить на ИИ все то, что создает сопротивление в вашей жизни и требует от вас шевилить мозгами. (Ахаха, это будет работать столь же безопасно, как шифрование в вацапе, ахахаха.) Марк такой же как Сэм: моя дочь любит готовить, поэтому не я буду помогать с рецептами, а мой агент.
-- У всех будут невероятные тулы для создания и выражения идей, создания бизнесов и т.п. ==> Но все примеры, которые приводит Марк (от "мы с дочкой собираем робота" до "мои инженеры генерируют новые кристалические структуры") -- это примеры с барьером входа. ИИ усиливает тех, у кого есть деньги.
-- У всех будет личный тренер с PhD в каждой области, который поможет изучить все, что вы хотите. ==> Мало того, что не очевидно, с чего я захочу учиться, если у меня есть умный помощник, так еще и все примеры поразительно не требующие PhD: выучить новые рабочие навыки, новые языки, новые хобби. Нет буквально на одного примера "ИИ поможет вам стать PhD".
-- ИИ поможет всем выиграть от научных достижений -- и далее по классике "вылечить все болезни на нашем веку". ==> Здесь Марк просто продвигает проект Присциллы - Biohub, но вообще ни разу не очевидно, что возможность персональных лекарств равнозначна их доступности. Как будто бы Марк не понимает, что это снова означает, что человек с деньгами просто будет еще более здоровым.
-- У всех будет бесплатный или доступный по цене доступ к этим инструментам. Но если вы хотите больше, у нас будет аукционная модель с данамическим ценообразованием. ==> И снова получается, что мы всех посадим на крючок, а потом дадим возможность рынку управлять ценами. К чему это приведет, тоже понятно. Но ответственность уже не на Марке.
====
Далее Марк долго рассуждает о разных рисках, но все это отдает таким вайбом "дворяне рассуждают о жизни крестьян".
👀 6 😱 3 👍 1 · всего 12
Перейти к публикации →
Несколько наблюдений/гипотез про Gen AI и кодинг, в частности: Есть вероятность, что мы близки к выходу на плато в некоторых сценариях и быстрому снижению маржинальности в них. -- С одной стороны, +- все крупные ИИ-вендора говорят о том, что они предоставляют…
Rozetked
ВИЛСАКОМ РЕД / WYLSACOM RED
Библиотека программиста
[netstalkers]
Типичный программист
СТАС БОМБИТ