
Латентность против качества: как подобрать модель под агента
Один и тот же промпт на GPT-4o отвечает за секунду, а на o1 может думать минуту. Разбираем, когда агенту нужна быстрая модель, когда — думающая, и как считать цену ошибки в деньгах и секундах.










