Большие языковые модели: что умеют, где врут и кому мешают
LLM за три года прошли путь от игрушки до инструмента, которым пользуются юристы, программисты и школьники. Разбираем, что у них внутри, где их предел и во сколько обходится час работы.
LLM за три года прошли путь от игрушки до инструмента, которым пользуются юристы, программисты и школьники. Разбираем, что у них внутри, где их предел и во сколько обходится час работы.

OpenAI показала метод PALMS: дообучение GPT-3 на выборке из 80 текстов заметно снижает токсичность ответов. Разбираем, что это за подход, где предел и почему это спорно.

Программа OpenAI Scholars завершилась девятью проектами — от интерпретации CLIP до генерации музыки. Разбираем, что именно сделали участники и зачем эти результаты нужны индустрии.

OpenAI открыла Triton — Python-подобный язык для написания GPU-ядер. Обещают производительность на уровне cuBLAS при десятках строк кода вместо сотен на CUDA.

Разбираем, во что обходится запуск ИИ-агента в компании до 50 человек: цена токенов, интеграций, поддержки и скрытые статьи, о которых не пишут в маркетинговых материалах.

Разница в счёте между GPT-4o и Gemini Flash на одной и той же задаче — двадцатикратная. Разбираемся, где переплата оправдана, а где вы просто жжёте бюджет.