Шаг был зелёным, но не проверял ничего: распознавание на раннере работает,
а шаблон искал число сразу после стрелки, тогда как в выводе между ними
стоит русское слово («-> блоков 29»). Совпадения не было, и шаг выходил
с предупреждением вместо проверки.
RenderTest теперь печатает итог машиночитаемой строкой RESULT — так же, как
selftest. Отсутствие этой строки считается провалом: значит конвейер не
доработал до конца. Пропуск остался только для случая, когда на машине нет
языкового пакета распознавания.
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
Программа накладывает русский перевод прямо на английские надписи —
как переводчик по фото, только для монитора. Работает с играми,
интерфейсами и документами: распознаёт кадр, собирает текст в связные
блоки, переводит и рисует плашки под цвет фона.
Распознавание — встроенный Windows.Media.Ocr, офлайн. Перевод — цепочка
движков с автопереключением (google, lingva, mymemory), потому что до
разных сервисов из разных сетей достучаться получается по-разному.
Собирается без .NET SDK: Roslyn из Build Tools плюс сборки Framework 4.8,
которые уже есть в системе. На выходе один exe без установщика.
Главная сложность оказалась не в переводе, а в том, чтобы понять, где на
экране связный текст, а где отдельные надписи. Классические алгоритмы
сегментации решают это по межстрочному зазору, но в плотном интерфейсе он
одинаков у строк абзаца и у соседних контролов. Поэтому решение принимает
ансамбль признаков: фон, граница между строками, заполненность строки,
кегль. Надписи на чужом языке отсеиваются тремя уровнями — форма слова,
вторая модель распознавания и частоты буквенных пар.
Чтобы правки эвристик не оценивались на глаз, в tools лежат эталонные
кадры и RenderTest: прогон конвейера без окна с подсчётом попаданий.
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>