Всем привет. Представляю способ изучения английского языка по книгам в формате json с озвучкой английского текста с помощью text‑to‑speech.

На моем сайте есть книги и сама страница озвучки, которая читает книгу в формате json и создает из нее интерактивный озвучиваемый текст. Суть метода это видеть английские слова, слышать их произношение и легко их сопоставлять с русскими. Вы не просто запоминаете переводы слов, а запоминаете речевые обороты, используемые в живой речи. И чтение книги это интереснее, чем просто заставлять себя учить слова.
Данные книги я готовлю с помощью нейросетей. Они качественно переводят текст и верно его разбивают на законченные смысловые фразы. Поэтому при чтении вам будет легко сопоставлять английские и русские слова. Если вы не доверяете переводу нейросети, то всегда есть рядом кнопка Перевести в гугл.
На сайте я открыл и объяснил формат json файла книги. Как предложение разбивается на части, где перевод, где словарь и так далее. Полная информация в книге и способность движка синтеза речи работать без интернета, позволяет читать эти книги где угодно. Так же страница озвучки позволяет читать книги на других языках. На сайте я показал как вы можете сами создавать такие книги с помощью нейросетей, в том числе на других языках.
Способ изучать язык по книгам с чередованием английского и русского текста не новый. Его изобрел Илья Франк. Я узнал об этом методе в 2003 году и уже тогда написал программу на Delphi которая озвучивала английскую часть текста. Архив интернета помнит мой сайт https://web.archive.org/web/20030720095443/http://www.epohaistoriy.narod.ru/. В то время готовить книги приходилось руками.
Сейчас, когда есть всемогущие нейросети, я решил воскресить проект. Тем более за последнее время на хабре видел уже две статьи с подобными идеями. Три недели вайбкодинга и 200$ ушло на проект. Хотя я не готовлю книги руками, создание книг даже с помощью нейросетей, это сложный многоходовый процесс. Поэтому мне не страшно на сайте рассказывать посетителям, как готовить книги самому. Более менее полноценную книгу дешевле купить, чем делать самому.
Сайт проекта https://озвучь.рф. Если вы на нулевом уровне английского языка, заходите туда дня через три. Размещу свою авторскую методику изучения языка с нуля. Возможно она будет полезна.
Комментарии (3)

Pavel_nobranch Автор
21.08.2026 16:48думаю, всё же написать свою программу типа «ПараТекст» для более удобного форматирования и сопоставления пары текстов.
в статье есть ссылка на мой сайт 2003 года, там покопайся и найдешь программу GoldenEggs это редактор с двумя окнами и он написан для удобного сопоставления текстов. Можешь посмотреть идею программы. А прогу напиши нейросетью.
Чтобы автоматизировать процесс, я использую запросы к «Гугл-транслэйт», в режиме «Текст», с помощью своих скриптов на Питоне. Задержку, между запросами выставляю – 11 секунд.
Используй gemmatranslate это локальная модель для перевода от гугл и на моем ryzen 3 3200g с 16гб без видеокарты работает замечательно. мои книги я переводил через чат в бесплатной нейросети и это долго. поэтому следующие буду через модель.
ну и на мой взгляд тебе пригодится почитать статью Как я упростил продукт в 10 раз.

cmyser
21.08.2026 16:48Так учить бессмысленно. С таким же успехом можно смотреть фильмы на английском с русскими субтитрами. Эффекта от такого изучения 0
Emelian
Я тоже работаю в этом направлении, но, как всегда, в подобных случаях, со своими нюансами. Вместо «json книг с озвучкой» использую файлы базы данных, формата Sqlite, для загрузки их в свою обучающую программу, что позволяет работать с ними в трех основных режимах («Конспект», «Видео» и «Экзамен») и трех альтернативных (когда оригинал и перевод меняются местами) – http://lecole.free.nf/articles.php :
Для двуязычных книг предпочитаю html-формат, Эксэл-формат и видео формат:
Представление в Эксэл – аналогичное (преимущество – удобство редактирования и форматирования), а видео формат для видео-книг можно посмотреть на примере французско-русских глаголов: https://my.mail.ru/mail/emmerald/video/_myvideo/27.html .
В принципе, фразы книг можно делать очень короткими, что способствует лучшему сопоставления перевода – оригиналу:
Я предпочитаю использовать бесплатные ИИ-сервисы.
У меня процесс создания двуязычных книг – следующий:
• Получаю регулярный текст на языке оригинала.
• Делаю его предобработку, с помощью собственного скрипта на Питоне.
• Перевожу с помощью «Гугл-транслэйт», в режиме «Текст», оригинальный материал. Кстати, это можно делать с помощью того же сервиса, но в режиме «Документ». Объем документов (pdf, xlsx, docx) до 10 Мб или до 300 страниц. В режиме «Текст» за раз доступно только 5000 символов. Но, режим «Текст» переводит точнее, там гораздо меньше литературной отсебятины, как в режиме «Документ».
Чтобы автоматизировать процесс, я использую запросы к «Гугл-транслэйт», в режиме «Текст», с помощью своих скриптов на Питоне. Задержку, между запросами выставляю – 11 секунд.
• Для исходного текста и его перевода я делаю их постобработку, с помощью того же Питона. Пытаюсь разделить длинные фразы на .короткие (сегментация) по знакам пунктуации и ключевым словам разделителям. Естественно, это не даёт полного соответствия, но сильно упрощает дальнейшую ручную правку двух текстов.
Правку можно делать в Notepad++ (в разных вкладках) либо в таблице «Ворда» с одной таблицей на лва столбца и одну строку, в которые я помещаю оригинальный текст и перевод. Эти способы работают, но, думаю, всё же написать свою программу типа «ПараТекст» для более удобного форматирования и сопоставления пары текстов.
• Имея сопоставление фразы разных текстов, можно уже легко сформировать двуязычную книгу любого формата.
P.S. если нужна озвучка для оригинальных фраз, то можно использовать бесплатные TTS-модели. Я применяю onnx-модели (в одной из последних статей, здесь, я описал эту технологию).