Проектная лаборатория
Собственный интерпретатор
Этап 05 · Основные этапы
Лексический анализ: лексические ошибки
Русский перевод заданий CodeCrafters. Примеры подготовлены для Go. Выбор языка меняет команды и результаты, но не текст задания.
На этом этапе вы добавите поддержку сообщений об ошибках при распознавании недопустимых токенов, таких как $, # и т. д.
Ссылка на книгу
Код для этого этапа реализован в разделе 4.5.1: Лексические ошибки.
Проверки
Тестирующая система выполнит серию проверок с файлами test.lox, содержащими неизвестные токены вместе с другими ранее введёнными типами токенов.
Например, если test.lox содержит следующее:
,.$(#Тестирующая система запустит вашу программу следующим образом:
$ ./your_program.sh tokenize test.lox
[line 1] Error: Unexpected character: $
[line 1] Error: Unexpected character: #
COMMA , null
DOT . null
LEFT_PAREN ( null
EOF nullОшибки следует выводить в поток stderr с префиксом [line N]. Если обнаружены лексические ошибки,
ваша программа должна завершиться с кодом 65.
Тестирующая система проверит, что:
- Поток stderr содержит по одной строке для каждой лексической ошибки (при их наличии).
- Каждая строка должна соответствовать формату
[line N] Error: Unexpected character: <character>.
- Каждая строка должна соответствовать формату
- Поток stdout содержит по одной строке для каждого корректного токена (даже при наличии других лексических ошибок).
- Ваша программа завершается с кодом 65, если есть лексические ошибки, и с кодом 0 в противном случае.
Поскольку символ новой строки ещё не введён, все ошибки будут начинаться с [line 1]. К ошибкам на разных строках мы перейдём на следующих этапах.
Примечания
- Этот формат вывода соответствует спецификации в репозитории книги
- Поскольку stdout и stderr — отдельные потоки, взаимный порядок ошибок и корректных токенов не важен. Вы можете выводить ошибки сначала, в конце или вперемешку с корректными токенами.
- Ошибками считаются только строки, начинающиеся с
[line N], поэтому остальные строки в stderr можно использовать для отладки. - При выделении токенов допускаются непарные круглые или фигурные скобки. На следующих этапах, когда мы перейдём к синтаксическому анализу выражений, такие случаи будут отмечаться как ошибки.
Проверка в вашей IDE
Нужны Node.js, Git, Go 1.24+ для тестеров и инструменты выбранного языка. Тестеры загружаются и запускаются локально; отдельным проектам нужны дополнительные системные зависимости.
Настройка проекта и IDE
1. Создайте проект один раз
node '/opt/graphlms/tools/project-lab/cli.mjs' init interpreter ./my-interpreter --language go2. Откройте папку в IDE
cd ./my-interpreterРеализуйте требования этапа в созданном проекте.
Запустите из папки проекта
node '/opt/graphlms/tools/project-lab/cli.mjs' submit --stage ea6Запускайте submit из папки проекта. Это локальные проверки, а не сертификаты или результаты аккаунта CodeCrafters.
Результат проверки
go / ЛОКАЛЬНОПодключение к локальной проверке…
Здесь появится результат
Запустите submit в терминале. Страница обновляет результаты каждые 8 секунд.