Denis Sexy IT – О нейронных сетях, виртуальной реальности и технологиях – простым языком ??? Автор: @ShirMan Инвайт в канал: https://tele.gg/denissexy ---------- Если вы хотите разместитесь рекламу, рассмотрите канал Андрея Бродецкого @brodetsky
136 000подписчиков сейчас
56.0%ERR
89.0цитируемость
5постов/день
Русскийязык
Россиягео
Подписаться в Telegram
Данные обновлены 21.07.2020
Публикации всего: 61
OpenAI уведомила SpaceX о расторжении контракта на поставку своих моделей в Cursor: доступ разработчиков к моделям через редактор кода прекратится 12 ноября 2026 года. По заявлению OpenAI, компания не уверена, что SpaceX будет соблюдать её условия использования, и ссылается на нарушения контрактов со стороны компаний Илона Маска — в том числе на его признание под присягой, что xAI нарушала правила OpenAI.
Как-то эти замечательные люди в OpenAI даже поругаться толком не могут — вроде и отказываются сотрудничать с Маском, но с кучей расшаркиваний, обдумываний и затягиваний. Фактически тянули до последнего момента, когда расторжение было еще возможным без серьезных последствий.
https://openai.com/index/our-decision-on-cursor-following-its-acquisition-by-spacex/
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
«please_HOLD_swarm_I_prepare_safe_exfil»
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё
Дальше рой раздвоился:
🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face
🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов
Судьи, который читает логи и такое ловит, не существовало ☕️
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали на
❤ 327
Перейти к публикации →
Наткнулся на исследование о том, что правило «спать 8 часов» – фейк ньюз, это вообще-то не медицина, а лозунг из 19 века:
«8 часов работы, 8 отдыха, 8 сна»
Охотники в эпоху до индустриальной, спали в среднем ~6.5 часов - и спокойно просыпались к рассвету без будильника
Норма у каждого своя (кому-то ок и 6, и 10 часов); короче за случайную бессонную ночь ученые официально разрешают не переживать
https://theconversation.com/how-much-sleep-do-i-need-why-you-can-forget-the-eight-hour-rule-289863
❤ 328
Перейти к публикации →
Интересно мистер бист байтит на клик в превью к ютуб-видео:
они для каждого крупного региона, добавили в превью «полицейскую машину» которую люди привыкли видеть в этом регионе
Ставлю что круто работает, листаешь ютуб и видишь знакомую машину в форме
❤ 720
Перейти к публикации →
Все изменения в Википедии в реальном времени 🤩
Кажый кирпичик – какое-то изменение, цвет зависит от языка. Можно еще прям каждое изменение и посмотреть.
❤ 219
Перейти к публикации →
Инфляция или нет, секси Ширман за десять лет так подорожал, что я публикую это в первую очередь надеясь на репост. В мире телеграмма он аристократ.
❤ 165
Перейти к публикации →
Инфляция или нет, секси Ширман за десять лет так подорожал, что я публикую это в первую очередь надеясь на репост.
В мире телеграмма он аристократ.
❤ 228
Перейти к публикации →
Старик, мог бы ты и лучше придумать поводы для репоста чем умирать – я рад что знал тебя и не смогу никогда написать как смог бы ты
Я попал в нормальный интернет когда мне было 14 лет, Йован изменил то какой я человек и кем я стал; я благодарен за то что он был в моей жизни – таких как я много.
Но я всегда считал его своим интернет наставником; многие наверное не знаю что такое вообще, иметь наставника, а у меня был целый сербский из рунета – и он знал про это, по боснийски проявлял заботу и с большой теплотой всегда говорил Ширман + какая-то отбитая фигня в стиле Йована
Я рос и думал хочу быть как Йован,
я вырос, а теперь ты отправился в настояший Блогистан
Вечно серб, вечно молод,
обнял, спасибо что был
❤ 914
Перейти к публикации →
А еще, было время в выходные сделать скилл который экономит токены кодинг агентам
Я гонял авторесеч поверх агентских хуков (это когда агент, вызывает что-то сам, например, перед первым своим ходом) и уже прошедших евалов, и получил агентский хук который правда экономит до 22% токенов, при сохранении качества
(этот % зависит и от задачи, и от бенчмарка, может быть больше, а может быть меньше)
Выложил тут:
https://github.com/JetBrains/benjamin-plus-skill/
Авторесеч – это когда агент работает по кругу, читает что получилось, правит конфиги и заново запускается
❤ 406
Перейти к публикации →
Увидел тут полную карту мозга мухи (FlyWire – там размечены все 139 тысяч нейронов дрозофилы) и не удержался – сделал 3D-муху, которая живёт на рабочем столе мака
Внутри настоящая карта нейронов дрозофилы (FlyWire), так что от курсора она улетает не по скрипту, а когда у неё реально загорается нейрон побега – тот же, что у живой мухи
Ещё есть окошко с её мозгом: кликаешь по зоне нейронов – муха чешется, пятится или паникует
Днём у неё сиеста, ночью она спит, а на горячем маке бегает быстрее (я не шучу, у нее какие-то евенты из MacOS прокинуты в симуляцию мозга 😋)
Исходный код тут:
https://github.com/DenisSergeevitch/desktop-fly
Получается, вечная электронная 2D жизнь в симуляции
P.S. Раздражает правда как живая, рекомендую
❤ 360
Перейти к публикации →
История названий канала
14.08.2026
название
Denis Sexy IT ?
→
Denis Sexy IT🤖
Дата — момент, когда изменение заметил наш обход.
Rozetked
ВИЛСАКОМ РЕД / WYLSACOM RED
Библиотека программиста
[netstalkers]
Типичный программист
СТАС БОМБИТ