Мониторинг
Модели
Отслеживание LLM, vision, embedding и генеративных моделей — курируемые источники и личный опыт.
Сравнение 548 моделей — интеллект, цена, скорость, задержка
548 моделей, сравнение по Intelligence Index, скорости (tok/s), цене за токен, латентности, контекстному окну. Открывается без регистрации.
↗Калькулятор VRAM для локальных LLM — какие модели запустятся на вашем железе
Живой калькулятор: выбираешь GPU → показывает какие модели влезут, с каким квантованием и контекстом. Учитывает KV cache, GQA, memory bandwidth. Русский, без регистрации, обновляется.