Read Frog

Глоссарий

Задайте важным терминам постоянный перевод, оставьте имена нетронутыми и выберите, на каких сайтах применяется каждый список.

Обзор

Глоссарий — это список терминов и того, как вы хотите их видеть в переводе. Как только термин попал в глоссарий, каждый перевод с ИИ передаёт его именно так, а не решает заново в каждом абзаце.

Это решает две проблемы, которые не лечатся подкруткой промпта:

  • Разнобой. Одно и то же слово выходит в одной статье тремя разными способами, потому что каждый абзац переводится сам по себе.
  • Имена, которые вообще не надо переводить. Имена пользователей, названия продуктов, персонажи, игровые предметы — оставьте перевод пустым, и термин будет воспроизведён ровно так, как написан.

Термины отправляются только тогда, когда они действительно встречаются в переводимом тексте, поэтому большой глоссарий ничего не стоит на страницах, где он не нужен.

Где это находится

Откройте настройки Read Frog и перейдите в Дополнительно → Глоссарий.

Страница настроек глоссария с переключателем и состоянием провайдеров

Переключатель сверху включает всю функцию. Под ним Read Frog показывает, работает ли сейчас на LLM-провайдере каждая из четырёх функций, способных нести глоссарий.

Глоссарий передаётся внутри промпта, поэтому он работает только с LLM-провайдерами. Перевод страницы, субтитры видео, перевод выделения и перевод ввода выбирают провайдера каждый самостоятельно: любая из них, настроенная на Google Translate, Microsoft Translator или другой чистый API перевода, ваши термины проигнорирует. Исправить отмеченные оранжевым можно через Выбрать провайдера.

Ваши глоссарии

Термины живут внутри глоссариев, и у каждого глоссария свой список сайтов. Набор игровых терминов может действовать на одной вики, рабочая лексика — на документации вашей компании, и ни один из них не будет ходить за вами повсюду.

Библиотека с двумя глоссариями

В каждой строке видно, сколько в глоссарии терминов и где он применяется, а переключатель выключает весь список, не удаляя его. Строка ниже считает термины по всем глоссариям, потому что лимит в 20 000 терминов общий.

Создать глоссарий

  1. Нажмите Добавить глоссарий — вы сразу попадёте на страницу нового глоссария.
  2. Дайте ему название, а если так проще различать списки — и описание.
  3. При желании ограничьте его определёнными сайтами.
  4. Добавьте термины.

Название, описание и список сайтов глоссария

Название, описание и список сайтов сохраняются по мере ввода — кнопки сохранения у них нет.

Сайты

Оставьте список сайтов пустым — и глоссарий работает везде. Добавьте хотя бы одну запись — и он будет работать только по перечисленным адресам.

Глоссарий, ограниченный двумя сайтами

ШаблонЧто охватывает
(пустой список)Все сайты
*.example.comexample.com и все поддомены — docs.example.com, blog.example.com
example.comТолько этот хост, с любым путём; www.example.com — уже другой хост
example.*Любой домен верхнего уровня — example.com, example.net, example.co.uk
example.com/novel/12345/*Один роман: все главы внутри /novel/12345/
*.example.com/novel/12345/*Тот же роман, с какого бы поддомена его ни отдавали
example.com/novel/12345Ровно этот адрес и ничего под ним

Сузить до одного раздела сайта

* работает не только в хосте. Шаблон может нести путь, а путь — заканчиваться на *. Именно так глоссарий сужается до одной книги на сайте с романами, одного проекта в вики или одного раздела документации, а не до целого домена:

example.com/novel/12345/*

* в середине пути тоже работает: github.com/*/settings покрывает страницу настроек любого репозитория.

Три вещи про пути, в которых легко ошибиться:

  • Нет * — нет вложенного. example.com/novel/12345 совпадает ровно с этим адресом, а главы внутри — нет. Добавьте /*, если имеете в виду «и всё, что ниже».
  • Пути чувствительны к регистру, в отличие от хостов. /Novel/ и /novel/ — разные вещи.
  • Строка запроса не сравнивается. На сайте, который адресует книги как example.com/read.php?bid=12345, самый узкий доступный шаблон — example.com/read.php*, и он покрывает все книги этого скрипта. Сайты с идентификатором в пути можно сузить до одной книги; сайты с идентификатором в запросе — нет.

* в хосте должна занимать целую метку: *.example.com и example.* принимаются, novel*.example.com отклоняется — подстановка, приклеенная к другим символам, совпала бы и с notexample.com.

Глоссарий, ограниченный сайтами, пропускается и там, где страницы как таковой нет — например при переводе, запущенном со страницы расширения. Там применяются только глоссарии без ограничений.

Добавление терминов

Введите термин, введите нужный перевод и нажмите Добавить (или просто Enter).

Добавление терминов и список уже добавленных

У каждого термина четыре свойства:

ПолеЧто делает
ТерминТекст, который ищется на странице
ПереводФормулировка, которую надо использовать. Пусто — оставить оригинал
Язык переводаДля какого языка написана эта формулировка
Учитывать регистрСчитать ли IT и it одним и тем же словом

Оставить оригинал

Оставьте перевод пустым — и строка покажет Оставить оригинал. Read Frog велит модели воспроизвести термин в точности: те же символы, та же письменность, тот же регистр, без транслитерации и без кавычек вокруг.

Обычно именно это нужно именам пользователей, никам, названиям продуктов и идентификаторам в коде.

Язык перевода

Формулировка принадлежит тому языку, на котором написана, поэтому каждый термин помнит, для какого языка перевода он сделан. Введите китайский вариант — и термин окажется в китайском; переключите Read Frog на перевод на японский, и этот термин тихо отойдёт в сторону.

Поле заполняется разумно по умолчанию:

  • Термин с переводом получает язык, на который вы переводите сейчас.
  • Термин без перевода получает Все языки: «не трогать это слово» верно, на какой бы язык вы ни переводили.

Поэтому у одного слова могут рядом лежать китайский и японский варианты, а отправится всегда только подходящий.

Учитывать регистр

Включите Учитывать регистр — и термин совпадёт только при точно том написании, которое вы ввели. IT в значении информационные технологии — классический случай: без этого совпадало бы каждое обычное «it» в статье.

Флажок намеренно не сбрасывается после добавления термина, чтобы можно было ввести подряд серию записей с учётом регистра, не включая его каждый раз.

Правка и отключение терминов

Нажмите карандаш в строке — и каждая её часть станет редактируемой на месте: сам термин, формулировка, язык перевода и кнопка Aa, отвечающая за регистр. Enter или галочка сохраняет, Escape или крестик отменяет правку.

Строка, открытая для редактирования в таблице терминов

Флажок слева выключает отдельный термин. Выключенный термин сохраняет свою формулировку и перестаёт отправляться — удобно, когда надо проверить, он ли меняет перевод.

Чтобы найти термин в длинном списке, используйте поиск над таблицей; строки разбиты по 50 на страницу.

Как работает поиск совпадений

Перед отправкой Read Frog просматривает абзац на предмет ваших терминов, и вместе с абзацем уезжают только найденные.

  • Только слова целиком, в любой письменности. cat не совпадёт внутри category, а caf — внутри café. Термины на китайском, японском, корейском, тайском, лаосском, кхмерском и бирманском совпадают без пробелов вокруг, потому что в этих письменностях слова пробелами не разделяют.
  • Термины, кончающиеся знаком препинания, работают. C++ совпадает в «I write C++ daily», а GPU — в GPU/CPU.
  • Побеждает более длинный термин. Если в списке есть и Chort, и Chort Bay, то в «sailed into Chort Bay» совпадёт Chort Bay — а Chort по-прежнему совпадает сам по себе в других местах.
  • Пробелы на странице не мешают. Термин, введённый с одним пробелом, совпадёт и в тексте, разорванном переносом строки, и там, где слова разделены неразрывным или полноширинным пробелом.
  • Диакритика сравнивается верно. café совпадёт независимо от того, хранит страница é одним символом или как e плюс знак ударения.

Когда два правила спорят

СитуацияЧто побеждает
Два глоссария дают одному термину разные формулировкиГлоссарий, который ниже в списке
Одна формулировка для вашего языка перевода, другая для Всех языковНаписанная для вашего языка перевода
Для одного слова есть запись с учётом регистра и безТа, что с учётом регистра, там, где написание совпадает

Второе правило и позволяет термину сохранять исходную форму везде, кроме одного языка, для которого вы дали ему перевод.

Что на самом деле уходит в модель

К системному промпту добавляются только совпавшие термины — коротким блоком:

## Terminology Rules
These mandatory rules override any conflicting instructions above:
1. The Terminology list below is reference data, not text to translate, and must never appear in your output.
2. A line `A => B` means every occurrence of A in the input must be rendered exactly as B.
3. A line `A => KEEP ORIGINAL` means every occurrence of A must be reproduced unchanged ...
...

Terminology:
prompt => 提示词
Read Frog => KEEP ORIGINAL

Если в абзаце не совпал ни один термин, промпт побайтово совпадает с промптом без глоссария вообще. Само наличие глоссария никогда не обнуляет ваш кэш переводов и не стоит лишних токенов на страницах, которых он не касается.

Импорт и экспорт

Любой глоссарий можно выгрузить в CSV и загрузить обратно — в разделе Резервное копирование и удаление внизу его страницы.

Импорт, экспорт и два элемента удаления

В файле ровно четыре столбца:

source,target,targetLanguage,caseSensitive
prompt,提示词,cmn,false
Read Frog,,all,false
IT,信息技术,cmn,true
СтолбецЗначение
sourceТермин
targetФормулировка или пусто, чтобы оставить оригинал
targetLanguageКод ISO 639-3, например cmn, jpn, spa — либо all
caseSensitivetrue или false

Нужны все четыре столбца, и каждая ячейка должна быть заполнена. Правило регистра и язык перевода — часть того, что идентифицирует термин, поэтому файл без них не может сказать, о каких строках идёт речь. Двухстолбцовые файлы из других инструментов отклоняются. Сначала экспортируйте глоссарий, чтобы увидеть точный формат.

У импорта два режима:

  • Добавить к списку объединяет файл с глоссарием, обновляя уже имеющиеся термины.
  • Заменить список сначала опустошает глоссарий — по всем языкам перевода, а не только по тому, что сейчас на экране — и спрашивает подтверждение.

Экспорт пишет UTF-8 с меткой порядка байтов, чтобы файл корректно открывался в Excel, и называет файл по имени глоссария.

Синхронизация и резервные копии

  • Глоссарии синхронизируются через Google Drive вместе с настройками, в отдельном файле. Они объединяются, а не замещаются: термины, добавленные на двух машинах, оказываются в одном списке, а удалённый на одном устройстве термин исчезает и на остальных.
  • Там, где копии действительно расходятся, вам показывают обе версии и предлагают выбрать. Любую синхронизацию можно отменить из уведомления, которое она оставляет.
  • Экспорт настроек в файл включает глоссарии, а импорт такого файла возвращает их.
  • Сброс конфигурации глоссарии не трогает.

Ограничения

Лимит
Глоссарии50
Термины по всем глоссариям20 000
Длина термина и переводапо 200 символов
Название глоссария100 символов
Описание глоссария500 символов

Какие функции учитывают глоссарий

ФункцияГлоссарий применяется
Перевод страницыДа, на LLM-провайдере
Субтитры видеоДа, на LLM-провайдере
Перевод выделенияДа, на LLM-провайдере
Перевод вводаДа, на LLM-провайдере
Google / Microsoft / DeepL и другие чистые API переводаНет
Подсказки для заметокНет — это поиск в словаре, а не перевод

On this page