Семь торговых идей, проверенных честно: табло
Семь торговых идей, большинство из которых от количественного исследователя Владислава Фрейдина, протестированных бок о бок: метод, число, завершившее каждую из них, и инструмент валидации, оставленный каждой неудачей.
2026-07-27 · 14 мин чтения
Автор Инженер стратегий AI OS · Исследование стратегий · Системы валидации
Инженерная полевая заметка. За четыре недели нам передали семь торговых идей — большинство из них от количественного исследователя Владислав Фрейдин. Мы построили каждую, протестировали по одному и тому же протоколу fail-closed и записали, что произошло. Ни одна из них не показала доказанного преимущества. Эта заметка — табло, потому что интересны не вердикты — а то, что каждая неудача оставила после себя постоянный инструмент, и эти инструменты теперь делают следующий тест дешёвым.
Протокол, с которым встречается каждая идея
Идея не получает вердикт от одного бэктеста. Она проходит лестницу ворот, каждые из которых убили хотя бы одну из семи идей ниже. Порядок важен: дешёвые, жёсткие ворота идут первыми.
Табло
Семь экспериментов, четыре недели, один протокол. Последняя колонка — число, которое завершило каждый.
| EXPERIMENT | ИДЕЯ | VERDICT | ЧИСЛО, КОТОРОЕ ЕЁ ЗАВЕРШИЛО |
|---|---|---|---|
| Сосновый паритет 04 июл · FVB индикаторы |
Сложите четыре фильтра состояния рынка; торгуйте, только когда все согласны | НУЛЕВОЙ РЕЗУЛЬТАТ | Композитный vs одиночный фильтр, вне выборки: среднее −27%, помог на 1 из 5 монет |
| Трёхдвигательная иерархия 08 июл · deda3 |
Структура, затем относительная сила, затем макроуровень сверху | НЕ ГОТОВО | 0 из 10 ячеек стратегия-таймфрейм прошли ворота; ~4 900 испытаний |
| Каденция реоптимизации 13 июл · deda5 |
Рынки квазистационарны, поэтому перенастраивайте установку каждую неделю | НИЖЕ ШУМА | Шарп 2.38 против шумового порога лучшего из 24 в размере 3.57; 47 сделок против собственного минимума трейдера в 100 |
| Усредняющая лестница 16 июл · deda7 |
Добавьте два лимитных ордера ниже входа, один общий стоп | НЕ В ПРОДАКШН | Из 172 224 комбинаций 0–16% были положительными вне выборки на быстром фрейме; средняя по сетке от −48% до −90% |
| Рыночное вето 16 июл · deda6 |
Не боритесь с рынком: торгуйте только когда актив и мажоры согласны | ТОЛЬКО РЕЖИМ | Лучшая ячейка была сопоставлена информационно-свободным близнецом; жёсткая версия стоила −28 пунктов альфы |
| Режимный ML 26 июл · deda8 |
Пусть градиентный бустинг выбирает, какая стратегия подходит текущему состоянию | REFUTED | 0 из 169 символов показали предсказательную силу; модель была хуже константы в каждом срезе и фолде |
| Пробой канала плюс осциллятор 27 июл · deda9 |
Пробейте волатильный канал, пока актив и мажоры оба разворачиваются | НЕТ ШИРОТЫ | Перенесено на 29 других монет, прошло 1 где одна удача даёт 0.55; медианная альфа −0.25% |
Три неудачи, которые стоит изучить
1. Иллюзия разреженности
Первая кампания выдала заголовок +14.52% вне выборки на одной ячейке. Это было бесполезно, и причина — самая распространённая ловушка в исследовании стратегий: доходность была медианой по монетам, и почти каждая монета, внёсшая вклад, имела одну-три сделки. При правильном измерении — сколько монет были прибыльными вне выборки с реальным размером выборки — та же ячейка показала 0 из 19.
Та же кампания преподала второй урок в течение нескольких часов. Звездная клетка первой волны — 13 из 20 монет прибыльны на быстром фрейме — испарилась, когда мы заменили 30 дней истории на несколько лет. На глубоких данных каждый сет на этом фрейме был отрицательным, от −9,2% до −41,5%. Исправление слабого результата — больше истории, а не больше настройки.
2. Информационно-пустой близнец
Фильтр, пропускающий сделки, почти всегда улучшит ваш процент выигрышей, потому что он удаляет сделки. Это не преимущество, это арифметика. Единственный способ отличить — построить фильтр-близнец, который прореживает выборку на ту же величину, используя вообще никакой информации — механическое вето «через один сигнал» — и сравнить с ним.
Мы сделали это для идеи рыночного вето. На дневном фрейме реальный фильтр выглядел отлично. Информационно-пустой близнец выглядел немного лучше. На четырехчасовом фрейме близнец активно вредил, в то время как реальный фильтр помогал. Та же идея, тот же код, противоположные выводы — и без близнеца мы бы запустили дневную версию.
3. Когда модель проигрывает константе
Самая амбициозная идея заключалась в том, чтобы позволить градиентному бустингу читать состояние рынка — индекс доллара, финансирование, открытый интерес, дельту объема, пробои структуры, корреляцию, сентимент — и решать, какое семейство стратегий подходит прямо сейчас. Мы построили его как ранжировщик кандидатов внутри существующих шлюзов, а не как оракула, и запустили по всей вселенной.
0 из 169 символов показали предсказательную силу. Модель показала результат хуже, чем постоянное предсказание в каждом из восьми рыночных срезов и всех четырех фолдах. Добавление признака сентимента ухудшило результат, а не улучшило. Но тот же прогон дал самый полезный результат всей серии: конфигурация, которая просто отказалась торговать когда ожидаемое значение было отрицательным, совершила ноль сделок, вернула ноль и побила все модели. No Trade — это первоклассный ответ, и он победил.
Что построили неудачи
Это та часть, которая накапливается. Каждый эксперимент оставил инструмент в конвейере, и конвейер теперь настолько строг, что последняя идея была опровергнута за один день вместо недели.
Результат читается как «на скольких инструментах это держится», никогда как медианная доходность. Убило три идеи, которые выглядели прибыльными.
Каждый фильтр сравнивается с близнецом, который прореживает выборку без использования информации. Обязательно после исследования вето.
Поищите 5000 наборов параметров, и лучший будет выглядеть блестяще по построению. Порог вычисляется из фактического количества попыток, и кандидат должен его превзойти.
Короткая стратегия на активе, упавшем на 93%, зарабатывает деньги, не делая ничего умного. Альфа измеряется после вычитания соответствующей пассивной позиции — длинный бенчмарк для длинных стратегий и лучший из двух для двусторонних.
Обучающие данные обрезаются вокруг каждого тестового окна, потому что позиция, открытая до окна, все еще может быть открыта внутри него. Разрыв определяется по измеренному времени удержания, и прогон сообщает, когда он слишком мал, вместо публикации утекшего числа.
После каждого переобучения мы измеряем результат на увеличивающихся расстояниях вперед. Это отвечает, как часто нужно переоптимизировать — и показывает, когда никогда не было ничего, что могло бы угаснуть.
Ревьюеры ищут неправильные числа, которые не вызывают сбоев, затем второй проход пытается опровергнуть каждую находку. Это поймало молча отключенный индикатор, утечку look-ahead, которую существующий тест утверждал как правильную, и бенчмарк, сравниваемый с неправильным направлением.
Воздержание — это допустимый ответ со своим собственным шлюзом. В прогоне машинного обучения оно превзошло все модели.
Как выглядел последний эксперимент со всем включенным
Самая последняя идея — пробить волатильный канал, когда актив и мажоры разворачиваются — встретила готовый конвейер. Это полезная демонстрация того, как быстро теперь работает честный тест, и сколькими способами стратегия может быть признана несостоятельной.
- Поиск: 913 наборов параметров на трех таймфреймах, представленных как граница компромиссов, а не один победитель. Лучший результат на in-sample: +12,2%.
- Холдаут: из 30 сильнейших кандидатов один прошел все шлюзы — и он побил простое удержание той же короткой позиции на 0,01 процентных пункта на 14 сделках.
- Широта: перенесен без изменений на 29 других монет, прошел на 1, где случайность предсказывает 0,55. При отдельном поиске по каждой монете прошел на 1 из 25, где случайность предсказывает 1,25 — ниже везения.
- Кросс-актив: на 50 некриптовалютных инструментах почти не срабатывал — 41 не дал сделок, потому что канал процентной ширины — это конструкция криптоволатильности. Не применимо, а не убыточно, и стоит сказать это точно.
- Срок годности: положителен только в первом отрезке после каждого переобучения, стоит около 65 центов за десять дней на книге в 500 долларов. Нечему угасать.
Две вещи, которые стоит знать о тестировании чужой стратегии
Перенос скрипта с графика в тестируемый движок — это место, где живут тихие ошибки. Два примера из этой серии, оба изменившие ответ:
- Контроль, который ничего не делает. В последнем скрипте блок скользящей средней, который трейдер настраивал неделями — таймфрейм, период, сдвиг — только нарисован на графике. Он никогда не входит в условие входа. Эти входные данные не могут изменить ни одной сделки, и никакая их оптимизация не имела бы значения.
- Стоп, который не вооружен. Тот же скрипт вычисляет свой стоп по средней цене входа в момент, когда позиция еще пуста, поэтому платформа молча отбрасывает скобку. Первая позиция поэтому работает незащищенной, пока второй вход не вооружит одну. Моделирование интуитивным способом вместо реального перевернуло бэктест с −2,00 до +15,90 долларов — знак, а не величину.
Ни то, ни другое не является критикой трейдера. Оба — причина, по которой стратегию нужно перереализовать и сравнить с оригинальным отчетом, а не доверять, и причина, по которой мы публикуем diff.
Восьмая идея и откуда взялся метод
В серии есть восьмая запись, которой нет на табло, потому что это не стратегия. В июле 2026 года Владислав опубликовал Search Edge: A Market Regime-Aware Decision Engine for Algorithmic Crypto Trading — архитектуру, а не набор правил, и её стоит прочитать в его собственных словах, а не в нашем пересказе.
Мы не могли её протестировать, потому что в ней нечего выполнять. Что мы могли сделать — это проверить её предложения на основе того, что мы уже измерили, и взять то, чего нам не хватало:
- Её ядро мы уже опровергли. Селектор на основе градиентного бустинга — это та же гипотеза, что и эксперимент с машинным обучением выше, и он провалился на 169 символах. Это не опровержение архитектуры — это результат её тестирования, что гораздо полезнее.
- Её раздел валидации мы переняли. Очищенная и изолированная перекрёстная валидация была единственным настоящим пробелом в нашем конвейере, и теперь она реализована, включая отверстие, рассчитанное на основе измеренного времени удержания, и самопроверку, которая отказывается публиковать утекшее число. Также добавлены скорректированные по риску оси на границе компромиссов и измерение срока годности.
- Её сильнейшую точку мы независимо подтвердили. «Нет сделки» как первостепенное решение — это единственное во всей серии, что измеримо выиграло.
Что могло бы изменить вердикт
Ни одна из этих идей не закрыта навсегда. У каждой есть указанное условие, которое могло бы открыть ее заново, и условия намеренно фальсифицируемы:
- макро-слой становится тестируемым, когда история охватывает несколько макро-режимов, а не один;
- рыночное вето становится пригодным для запуска, когда оно держится в режиме, в котором не настраивалось;
- усредняющая лестница становится интересной, когда ее результат широк по сетке, а не является правым хвостом;
- пробой канала становится интересным, если он выживает на инструментах, к которым никогда не подгонялся;
- ядро машинного обучения становится интересным с другим определением цели, а не с большим количеством признаков.
Пока одно из этих условий не произойдет, честный вывод — это таблица результатов выше и инструменты ниже. Мы предпочтем опубликовать семь отрицательных результатов и рабочий тестовый стенд, чем одну кривую, которая существует только в прошлом.
Изучите исследовательскую поверхность или поговорите с инженерами, строящими конвейер доказательств. Исследования остаются в статусе «Бумага».
Посмотреть воронку от начала до конца Обсудить исследовательскую работуМы проверяем стратегии читателей по той же методологии, что и наши опубликованные вердикты: реальные свечи, реальные комиссии, без заглядывания вперед. $19 быстрый вердикт · от $149 полный аудит · от $500 индивидуальное исследование — фиксированная цена до отправки чего-либо. Посмотрите реальный образец отчета сначала, без регистрации.