Если в RAG (Retrieval-Augmented Generation) выявлены неполные данные и плохая передача контекста в LLM (Large Language Model), стоит предпринять следующие шаги:
В типичном учебном примере одновершинного правосторонне скошенного распределения длинный правый хвост сильнее сдвигает среднее, чем медиану. Поэтому обычно ожидают среднее > медиана, а часто и мода < медиана < среднее.
Ошибка первого рода — это ложное срабатывание теста, когда мы отвергаем нулевую гипотезу, хотя она верна. Проще говоря, мы считаем, что есть эффект, когда его на самом деле нет.
Объясните, что именно вас привлекает: превращение неясного бизнес-вопроса в проверяемую гипотезу, поиск закономерностей, эксперименты, визуализация или помощь команде в принятии решений.
Сначала уточню границы: считаем специалистов, работающих в Москве, включая обслуживание жилья, организаций и другие сантехнические работы. Удобнее сначала оценить эквивалент полной занятости, а не число уникальных людей.