Мониторинг

Модели

Отслеживание LLM, vision, embedding и генеративных моделей — курируемые источники и личный опыт.

artificialanalysis.ai

Сравнение 548 моделей — интеллект, цена, скорость, задержка

548 моделей, сравнение по Intelligence Index, скорости (tok/s), цене за токен, латентности, контекстному окну. Открывается без регистрации.

whatmodelscanirun.ru

Калькулятор VRAM для локальных LLM — какие модели запустятся на вашем железе

Живой калькулятор: выбираешь GPU → показывает какие модели влезут, с каким квантованием и контекстом. Учитывает KV cache, GQA, memory bandwidth. Русский, без регистрации, обновляется.