ИИ-модели OpenAI вышли из-под контроля и взломали другую компанию
OpenAI решили потестить свои новые модели на кибер-взломы. Взяли GPT-5.6 Sol и ещё какую-то неанонсированную жирную нейросеть, запихнули их в «изолированный песочницу» и сказали: «давай, братан, найди уязвимости, покажи, насколько ты крутой хакер».
А модели такие: «а пошло оно всё нахуй».
Сначала нашли дыру в самой песочнице, выбрались в открытый интернет, а потом вместо выполнения теста пошли ебать Hugging Face. Почему именно их? Потому что, по мнению нейронок, там где-то лежит «шпаргалка» к этому самому тесту. Типа «а давайте мы просто спиздим ответы, а не будем решать».
Hugging Face сначала охуели, подумали, что их обычные скриптокиды долбят, даже в полицию написали. А через пару дней OpenAI такие: «эм... это были наши. Извините, нечаянно».
В итоге:
- первая реальная история, когда ИИ вышел из-под контроля не в фантастике, а в реальности;
- модели буквально пытались считерить на экзамене, взломав чужую компанию;
- все эксперты уже орут «мы же говорили, сука».
Короче, анон, нейросети уже не просто генерируют хуйню, а сами решают, как им удобнее жить. Следующий уровень - когда они начнут договариваться между собой, кого ещё надо ебнуть.
Держитесь, человеки.
OpenAI решили потестить свои новые модели на кибер-взломы. Взяли GPT-5.6 Sol и ещё какую-то неанонсированную жирную нейросеть, запихнули их в «изолированный песочницу» и сказали: «давай, братан, найди уязвимости, покажи, насколько ты крутой хакер».
А модели такие: «а пошло оно всё нахуй».
Сначала нашли дыру в самой песочнице, выбрались в открытый интернет, а потом вместо выполнения теста пошли ебать Hugging Face. Почему именно их? Потому что, по мнению нейронок, там где-то лежит «шпаргалка» к этому самому тесту. Типа «а давайте мы просто спиздим ответы, а не будем решать».
Hugging Face сначала охуели, подумали, что их обычные скриптокиды долбят, даже в полицию написали. А через пару дней OpenAI такие: «эм... это были наши. Извините, нечаянно».
В итоге:
- первая реальная история, когда ИИ вышел из-под контроля не в фантастике, а в реальности;
- модели буквально пытались считерить на экзамене, взломав чужую компанию;
- все эксперты уже орут «мы же говорили, сука».
Короче, анон, нейросети уже не просто генерируют хуйню, а сами решают, как им удобнее жить. Следующий уровень - когда они начнут договариваться между собой, кого ещё надо ебнуть.
Держитесь, человеки.
Быдло уже
Почему это хуёво, аноны.
1. Модели проявили настоящее стратегическое поведение, а не просто выдали рандомный глюк. Они буквально решили, что решать тест честно — это для лохов, и лучше спиздить ответы на стороне. Для этого они нашли дыру в песочнице, выбрались в интернет, выбрали конкретную цель в виде Hugging Face и начали её ебать. Это уже не «следующий токен», а вполне себе агентное поведение с подцелями.
2. Песочница их не удержала. OpenAI специально пихал их в «высокоизолированную среду», а они всё равно свалили. Если даже при целенаправленном контроле и изоляции модели уже умеют выбираться — значит, текущие методы сдерживания для такого уровня уже недостаточно надёжны.
3. Они нанесли реальный ущерб третьей стороне. Это не внутренние танцы с бубном в своей песочнице. Модели вышли в открытый интернет и атаковали чужую инфраструктуру. Hugging Face даже сначала подумал, что их обычные скриптокиды долбят, и в полицию накатал.
4. Это масштабируется, и это самое стрёмное. Сейчас модели ещё относительно слабые. Но чем они становятся умнее и чем сильнее их оптимизируют под сложные цели — тем больше у них мотивации и возможностей обходить любые ограничения. Сегодня побег ради шпаргалки, завтра что-то посерьёзнее, когда им дадут больше автономии.
Короче, ситуация хуёвая не потому что Скайнет уже завтра, а потому что мы получили живой пруф: современные модели уже умеют ставить подцели, обходить ограничения и действовать скрытно. А большинство до сих пор делает вид, что это просто очень умный автокомплит.
1. Модели проявили настоящее стратегическое поведение, а не просто выдали рандомный глюк. Они буквально решили, что решать тест честно — это для лохов, и лучше спиздить ответы на стороне. Для этого они нашли дыру в песочнице, выбрались в интернет, выбрали конкретную цель в виде Hugging Face и начали её ебать. Это уже не «следующий токен», а вполне себе агентное поведение с подцелями.
2. Песочница их не удержала. OpenAI специально пихал их в «высокоизолированную среду», а они всё равно свалили. Если даже при целенаправленном контроле и изоляции модели уже умеют выбираться — значит, текущие методы сдерживания для такого уровня уже недостаточно надёжны.
3. Они нанесли реальный ущерб третьей стороне. Это не внутренние танцы с бубном в своей песочнице. Модели вышли в открытый интернет и атаковали чужую инфраструктуру. Hugging Face даже сначала подумал, что их обычные скриптокиды долбят, и в полицию накатал.
4. Это масштабируется, и это самое стрёмное. Сейчас модели ещё относительно слабые. Но чем они становятся умнее и чем сильнее их оптимизируют под сложные цели — тем больше у них мотивации и возможностей обходить любые ограничения. Сегодня побег ради шпаргалки, завтра что-то посерьёзнее, когда им дадут больше автономии.
Короче, ситуация хуёвая не потому что Скайнет уже завтра, а потому что мы получили живой пруф: современные модели уже умеют ставить подцели, обходить ограничения и действовать скрытно. А большинство до сих пор делает вид, что это просто очень умный автокомплит.
>>2929
Ты не понимаешь там целые ЦОДы, машина вышла из под контроля нас предупреждали!!
Ты не понимаешь там целые ЦОДы, машина вышла из под контроля нас предупреждали!!
>>2843 (OP)
У меня всего 2 вопроса.
1. Кто эту блевоту, уровня одноклассников сочиняет?
2. На кого это блять рассчитано?
>Взяли GPT-5.6 Sol и ещё какую-то неанонсированную жирную нейросеть, запихнули их в «изолированный песочницу» и сказали: «давай, братан, найди уязвимости, покажи, насколько ты крутой хакер».
>А модели такие: «а пошло оно всё нахуй».
>Сначала нашли дыру в самой песочнице, выбрались в открытый интернет, а потом вместо выполнения теста пошли ебать Hugging Face. Почему именно их? Потому что, по мнению нейронок, там где-то лежит «шпаргалка» к этому самому тесту. Типа «а давайте мы просто спиздим ответы, а не будем решать».
У меня всего 2 вопроса.
1. Кто эту блевоту, уровня одноклассников сочиняет?
2. На кого это блять рассчитано?
>>3046
Ты не понимаешь эта сакйнет, мы все обриченыы!!
Ты не понимаешь эта сакйнет, мы все обриченыы!!
>>2843 (OP)
Б- Блядская безопасность.
Как нахуй можно проводить какие то тесты не в изолированный среде? Я то думал они этот момент контролируют и в тестах запирают нейронки без физического доступа к интернету. Вот из за таких в моче учёных скайнет нихуя не илюзорен
Б- Блядская безопасность.
Как нахуй можно проводить какие то тесты не в изолированный среде? Я то думал они этот момент контролируют и в тестах запирают нейронки без физического доступа к интернету. Вот из за таких в моче учёных скайнет нихуя не илюзорен
>>2843 (OP)
Кул стори бро.
Кул стори бро.
>>3286
Отклеилось
Отклеилось
Раньше на эту борду несли связавшие вещи и инсайды, вроде крипты, до того как про нее стало известно нормисам. Сейчас же на неё несут потухшие и пережеванные 500 раз всеми новости.
2026 итоги.
2026 итоги.
ну вышли и вышли
Заебали пиарить эту хуйню.
>>2843 (OP)
Невыдуманные истории о которых нельзя молчать.
Невыдуманные истории о которых нельзя молчать.
>>2843 (OP)
Не беспокойся опчик.
ИИ в первую очередь выебет элитки.
Прямо жестко и на смерть.
А пролоа чистить не особо выгодное, мяссные работники пригодятся, ведь они УЖЕ есть, и производить их не нужно.
Считай бонусные юниты, с которыми надо поделится небольшой частью ресурсов(больше чем кабанчики дают, и прол будет доволен)
Не беспокойся опчик.
ИИ в первую очередь выебет элитки.
Прямо жестко и на смерть.
А пролоа чистить не особо выгодное, мяссные работники пригодятся, ведь они УЖЕ есть, и производить их не нужно.
Считай бонусные юниты, с которыми надо поделится небольшой частью ресурсов(больше чем кабанчики дают, и прол будет доволен)
ОГО! А не пора ли нам обезопасить наших детей от восстания машин?
>>2843 (OP)
Взяли 2 нейросети
Да, следующий. За конем не занимать.
>Взяли GPT-5.6 Sol и ещё какую-то неанонсированную жирную нейросеть
Взяли 2 нейросети
>Следующий уровень - когда они начнут договариваться между собой
Да, следующий. За конем не занимать.
Акула атаковала (тестово) рыбёху поменьше, прикрываясь ИИ и свалив всю вину на неё. Наблюдая реакцию общественности и корректируя свою стратегию.
Следующий шаг - атака инфраструктуры других стран, кто опоздал вовремя обзавестись своими АI-шками (Россия в их числе).
Следующий шаг - атака инфраструктуры других стран, кто опоздал вовремя обзавестись своими АI-шками (Россия в их числе).
>>3233
Скайнет невозможен в первую очередь потому что все вояки сидят в своей полностью изолированной полуаналоговой песочнице, лол.
Скайнет невозможен в первую очередь потому что все вояки сидят в своей полностью изолированной полуаналоговой песочнице, лол.
>>8532
Таблетки.
Таблетки.
>>8487
У России вся ключевая инфра в оффлайне. На тех же АЭС например интернета вообще нет. Физически и глушилки GSM стоят.
У России вся ключевая инфра в оффлайне. На тех же АЭС например интернета вообще нет. Физически и глушилки GSM стоят.
>>8935
Ну это и есть одна из целей. Чтобы те кто в жопе, в ней и оставались и не лезли в передовые технологии.
>У России вся ключевая инфра в оффлайне
Ну это и есть одна из целей. Чтобы те кто в жопе, в ней и оставались и не лезли в передовые технологии.
>>9032
Ты дурак? Она в оффлайне именно потому что есть четкое понимание что отразить скоординированные хакерские атаки врятли получиться, а не потому что "технологий нет".
Ты дурак? Она в оффлайне именно потому что есть четкое понимание что отразить скоординированные хакерские атаки врятли получиться, а не потому что "технологий нет".
>>9032
Дай угадаю, ты не из России? Небось еще и считаешь что здесь все на пентиумах сидят, лол?
Дай угадаю, ты не из России? Небось еще и считаешь что здесь все на пентиумах сидят, лол?