Про пять лотов Бинго!=D Попал в точку, я как раз в это и упёрся. Только у меня это не правило, а замер: как я и сказал, в демо при уменьшении книги с 5 млн до 250 тыс доля позиций, округлённых в НОЛЬ, растёт с 0.8% до 7.6%. И там же вылезла вещь, которой я не ожидал: если инструментов остаётся два, кросс-секция вырождается математически — веса после центрирования и нормировки становятся ровно ±0.5 всегда, меняется только знак. То есть это уже не портфель, а один спред. Так что согласен: ограничение на использование, а не на разработку, но при этом оно меняет саму конструкцию, а не только масштаб.
А про два отрезка — вы описали ровно то, что у меня стоит в коде(кстати, гитхаб разфлажил, Но потребовал оставить приватным, пока выясняю в чем причина. Так что отзеркалил на гитлаб :( gitlab.com/andreyvarakin29/quant-validation), только я перебираю все разбиения, а не одно. Режу историю на 16 блоков и беру ВСЕ способы взять половину как обучение, остальное как проверку: C(16,8) = 12 870 вариантов, и каждый идёт вместе со своим зеркальным — то есть ровно ваше «система 1 приемлема на отрезке 2, и наоборот», просто много раз. Смотрю не на ухудшение, а на ранг: как часто лидер обучения оказывается на проверке ниже медианы.
И тут я с вами наполовину. Число само по себе действительно так себе параметр — я поэтому и прогоняю ту же процедуру на заведомо известных наборах, чтобы понимать, что она вообще выдаёт. Но одну вещь оно ловит, а впечатление не ловит: случай, когда отбор систематически выбирает будущего аутсайдера. Это видно только на многих разбиениях, на двух отрезках такое можно списать на невезение.
С последним да, солидарен: решение «брать или не брать и с какой долей» ни одна метрика за меня не примет. Но они и нужны только чтобы отсеять то, что брать точно нельзя.
Про вырождение двух ног я вам вчера считал — цифры проверенные, ±0.5 подтверждается чисму, почему «пять лотов» у вас не просто про размер счёта.

