
Почему безопасность ИИ упирается в социологов, а не только в код
Выравнивание моделей всё чаще ломается не на математике, а на людях: чью пользу оптимизировать, как собирать оценки и почему разметчики не согласны друг с другом.

Выравнивание моделей всё чаще ломается не на математике, а на людях: чью пользу оптимизировать, как собирать оценки и почему разметчики не согласны друг с другом.

OpenAI выложила Spinning Up in Deep RL бесплатно: теория, шесть алгоритмов с кодом и список статей для чтения. Разбираем, кому этот материал реально поможет войти в обучение с подкреплением, а кому стоит поискать другое.

Neural MMO — открытая среда, где сотни и тысячи обучаемых агентов борются за еду, воду и территорию одновременно. Разбираем, чем она отличается от классических RL-песочниц и зачем такой масштаб исследователям.

Энергетические модели снова в игре: вместо явной генерации они учат функцию энергии и достают образцы через MCMC. Разбираем, как это работает и где спотыкается на практике.

OpenAI и Google Brain показали Activation Atlases — способ развернуть на плоскости то, что распознаёт свёрточная сеть внутри. Это не просто картинки: атлас вскрывает и слабые места классификаторов.

В апреле 2019 года бот OpenAI Five победил команду OG — действующих чемпионов The International — со счётом 2:0. Разбираемся, что стояло за этой победой и почему она важнее шахмат и го.

Полное внимание в трансформере стоит O(n²) по памяти и времени. Разреженные схемы внимания снижают эту стоимость и позволяют работать с длинными последовательностями — от геномов до аудио и изображений.

Модель, обученную держать удар против L-бесконечности, легко ломает L2 или пятно-патч. Разбираем, почему робастность не переносится между типами возмущений и что с этим делать инженеру.

OpenAI Fellows — программа, через которую разработчики без опыта в ИИ-исследованиях переходили в них за полгода. Разбираем, что она давала, чем закончилась и что пришло на смену.

OpenAI показала CLIP в январе 2021 года — модель, которая сопоставляет изображения и подписи к ним и классифицирует картинки по описанию, а не по заранее заданным ярлыкам. Разбираем, как она устроена и где реально пригодилась.

Программа OpenAI Scholars дала восьми участникам три месяца, стипендию и наставника, чтобы с нуля войти в глубокое обучение. На выходе — публичные проекты, блог-посты и код. Разбираем, как устроена такая траектория и кому она подходит.

Выделенный день на обучение сотрудников выглядит как приятный бонус, но у бухгалтерии к нему есть вопросы: это рабочее время или отгул, кто платит и как учесть расходы.