Раннер падал каждые две с половиной минуты, а job для одного репозитория не мог запуститься больше суток. Мы искали сетевой баг — с захватом пакетов и дампом памяти в WinDbg. Настоящая причина оказалась в одной строке фильтра API и логике watchdog'а.
Поскольку проект состоял из пяти репозиториев, каждый из них обзавёлся своей собственной CI. Красиво архитектурно — и дорого по минутам GitHub Actions. Подняли свою Windows-машину с одним раннером на всех пятерых — и написали для него сторожа, которому предстояло с треском провалиться меньше чем через сутки.