Тесты avr-latency v37

Регрессионные суиты стека. Каждая написана после конкретного бага, доехавшего до живого звонка, и проверяет, что он не вернулся. Ничего не стоят: ни одного вызова LLM, ни одного звонка — в отличие от «Понимания сценария» на странице статистики. Жать можно сколько угодно. · ← живая панель · Статистика · Сравнение LLM · Сравнение STT · EOU Lab

Как читать

прошла все проверки зелёные
провал есть красная проверка — она ниже, с got/want
пусто суита завершилась успешно, но не напечатала ни одной проверки. Это не успех: так выглядит тест, который переименовали или сломали так, что он молча ничего не проверяет.
падение процесс упал до проверок — смотрите stderr
нет файла суита не попала в образ при сборке
агент недоступен контейнер agent не ответил — его суиты не прогонялись, а не «прошли»
Почему здесь нет test_heavy_models.py. Он грузит TEN Turn и UltraVAD на CPU и просит 10–16 ГБ RAM. Контейнер agent в том же процессе принимает звонки, так что кнопка, способная выесть память прода, — не фича. Этот тест гоняют руками на машине, которая не на линии.
Полный прогон пишется в историю на /stats как selftest; отдельные суиты — нет, чтобы не топить в себе платные прогоны понимания.