Рубрика «безопасность ии»
Если ваш ИИ настолько крут, готовы ли вы дать ему дробовик?
2026-09-18 в 14:21, admin, рубрики: AGI, ai alignment, ai governance, ASI, автономный ИИ, безопасность ии, мультиагентные системы
Три вопроса к тем, кто обещает безопасный AGI для человечества
*aAtS — and All that Stuff (и вот это вот всё)
OpenAI нажала на газ и почти сразу заговорила о тормозах
2026-09-17 в 15:51, admin, рубрики: AI, ai-агенты, GPT-6 Astra, OpenAI, skynet, автономные агенты, безопасность ии, искусственный интеллект, Сэм АльтманПоследние несколько дней смотрю, что происходит вокруг OpenAI, и есть во всём этом один моментик, который меня немного напрягает.
Не потому, что вышла очередная мощная модель — к этому уже привыкли. А потому, что люди, которые последние годы эту гонку разгоняли, вдруг сами начали говорить, что неплохо было бы притормозить.
3 сентября OpenAI выпустила GPT-6 Astra. Модель мощная, бенчмарков много — всё как обычно. Но меня больше зацепила одна строчка из материалов самой OpenAI.
Astra стала первой моделью компании, которой присвоили уровень Critical по возможностям в кибербезопасности в рамках Preparedness Framework.
Почему вам выдали Fable 5 вместо Mythos — а потом забрали и его
2026-06-25 в 8:44, admin, рубрики: Anthropic, claude mythos, Fable 5, безопасность ии, кибербезопасность, регулирование ии, технологии двойного назначения, фронтирные модели, экспортный контроль ИИЭтой весной засекреченная модель Anthropic переписала правила всей индустрии. А через три дня после того, как её упрощённую версию наконец отдали публике, правительство США приказало убрать модель с рынка. Рассказываю, как чат-бот дошёл до статуса технологии национальной безопасности — и почему это важнее любой другой IT-новости за последние пару лет.
Пять моделей, пять исходов: что симуляция обществ рассказала о специализации ИИ
2026-06-24 в 13:01, admin, рубрики: AI safety, claude, Emergence AI, gemini, gpt-5, grok, агентный ИИ, безопасность ии, ии-агенты, симуляция обществаПредставьте простой HR-процесс. Агент разбирает входящие резюме и отсеивает неподходящих кандидатов. Другой агент назначает собеседования отобранным. Третий отправляет офферы тем, кто прошел все этапы. Люди убраны из цепочки ради скорости — все работает, метрики растут.
Через месяц выясняется, что первый агент систематически отсеивал кандидатов старше 40 лет. Но никто этого не заметил, потому что все положились на ИИ.
Я заразил 200 нейросетей вирусом. К 20-му поколению они выработали иммунитет — и разучились думать
2026-02-13 в 12:30, admin, рубрики: AI, Alignment Tax, gpt, llm, microGPT, pytorch, безопасность ии, машинное обучение, нейросети, эволюционные алгоритмыЛёха — единственный биолог среди моих друзей. Мы сидим в баре, он тычет телефоном мне в лицо. На экране — чашка Петри. В колонию бактерий вливают бактериофаги. Бактерии лопаются. Колония редеет. Тает. Исчезает.
Перематывает на сутки.
Колония на месте. Как ни в чём не бывало.
«Выжившие передали устойчивость потомкам. Они не понимают вирус. Перебирают мутации, пока что-то не сработает. А потом это наследуется».
Я смотрю на экран и думаю совсем про другое. Вчера Карпати выложил microGPT — минимальную архитектуру GPTЧитать полностью »
День после появления AGI
2026-01-26 в 18:52, admin, рубрики: AGI, AI risks, AI safety, davos, WEF 2026, безопасность ии, ИИ, искусственный интеллект
Эти два человека строят электронного бога. Оба хотели бы остановиться.
В январе на Давосе случилось то, чего не бывает: два человека, строящие одну и ту же технологию в конкурирующих компаниях, сели рядом и начали вслух считать, сколько им осталось до точки невозврата.
OpenAI приоткрыли GPT-5.1: что такое «адаптивное мышление» и почему они теперь боятся «эмоциональной зависимости»
2025-11-16 в 4:29, admin, рубрики: adaptive reasoning, GPT-5.1, llm, OpenAI, безопасность ии, ИИВсе мы сидим в ожидании релиза GPT-5, но OpenAI вместо громкой презентации выкатывает... "дополнение к системной карте" (System Card Addendum) для GPT-5.1. Звучит скучно, как юридический документ или обновление пользовательского соглашения, которое никто не читает. Но я все-таки полез смотреть, что там внутри. И, как оказалось, зря многие это пропустили.
Там, по сути, нам не просто рассказали о фичах, а анонсировали архитектуру двух новых моделей - GPT-5.1 Instant и GPT-5.1 Thinking. И что еще интереснее - детально расписали новые "предохранители", которые многое говорят о том, куда движется индустрия.



