Вы здесьОбновление скрипта "Поиск по набору регэкспов" для FBE - тестируем!
Опубликовано пт, 06/09/2019 - 04:13 пользователем TaKir
Дошли руки существенно дополнить, обновить, почистить и структурировать по смыслу скрипт "Поиск по набору регэкспов" для Fiction Book Editor (FBE). Автор этого скрипта (как и многих других скриптов для FBE) - Sclex, за что ему отдельное гран мерси. Наполнение скрипта мое, Sclex-а + учтены все возможные пожелания книгоделов из двух старых здешних тем: Типичные ошибки распознавания... Пользоваться и тестировать могут все желающие, отзывы, примеры, предложения по улучшению категорически приветствуются. Просьба приводить конкретные примеры: - ошибок скрипта, ложных срабатываний Очень приветствуется помощь тех, кто хорошо знаком с регулярными выражениями для дальнейшего совершенствования скрипта. Ссылка на последнюю версию скрипта (30-09-2019): альтернативные ссылки: Заменить этим файлом имеющийся файл (или положить новый вариант скрипта рядом) в папке: Скрипту удобнее назначить горячую клавишу F2 (меню: Сервис-Настройки-Клавиши-Скрипты-Поиск по набору регэкспов). Перед запуском данного скрипта лучше обработать текст скриптами "Генеральная уборка", "Латиница в кириллице" По мере накопления отзывов о работе скрипта, планирую периодически пополнять скрипт и выкладывать обновленную версию. P.S. На Флибусте открыта аналогичная тема, можно писать в любую.
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
Isais RE:Беженцы с Флибусты 1 час
tvv RE:Доступ 27 19 часов Isais RE:Вадим Иванович Туманов - Всё потерять - и вновь начать с... 21 час Isais RE:Семейственность в литературе 3 дня Isais RE:Древний Рим. Подборка книг 3 дня Саша из Киева RE:Подайте бедному копеечку на книжку с литреса... 5 дней Саша из Киева RE:"Экс" и "нео": разноликие правые 5 дней medved RE:Предупреждение: "зеркала" флибусты 2 недели Isais RE:Соседи 2 недели babajga RE:Как сова отправилась в отпуск 3 недели Саша из Киева RE:Горящие паруса 1 месяц Саша из Киева RE:Подвиг героев - судьба страны. МНР: люди и годы 1 месяц commodore RE:Письма 1 месяц Саша из Киева RE:Три минуты истории 1 месяц nehug@cheaphub.net RE:Как бы с этим побороться и побороть? 1 месяц Саша из Киева RE:Книги на латышском языке 1 месяц stevecepera RE:Список современных французских писателей? 2 месяца etorus2008 RE:Отв: Помогите найти книгу по описанию 2 месяца Впечатления о книгах
Barbud про Лео: Сделай что сможешь. Развивая успех (Альтернативная история, Исторические приключения, Попаданцы, Самиздат, сетевая литература)
17 07 Все по-прежнему. ГГ, несмотря на мальчишеское тело, непомерно крут - ворочает огроменными деньжищами, в стрельбе побеждает офицеров, из незнакомого лука навскидку попадает по заказу куда просят, предприниматели, военные и ……… Оценка: неплохо
Лысенко Владимир Андреевич про Ераносян: Доброволец (Альтернативная история, Боевик)
17 07 Нет не сюжета, все свалено в одну кучу. Оценка: нечитаемо
voronin345 про Ераносян: Доброволец (Альтернативная история, Боевик)
17 07 один бандюк супротив другога бандюка....прелесть!!! Оценка: нечитаемо
мила7 про Куно: Повенчанные временем [litres] (Любовная фантастика)
15 07 Хорошо написано. Мне понравилось. Оценка: отлично!
Lena Stol про Видум: Договор (Фэнтези, Попаданцы, ЛитРПГ, Самиздат, сетевая литература)
15 07 Не понравилось - сюжет почти не двигается, герой занят прокачкой себя любимого. Надоело перечисление навыков, что за чем следует, что ещё надо прокачать и т.д. Оценка: плохо
Саша из Киева про Алексеев: О русской доблести и славе (Историческая проза, Детская проза, История, О войне)
14 07 Как жаль, что Сергей Петрович Алексеев не написал об Александре Невском!
StrelaVV про Зазеркалье [Шарапов]
14 07 Первая книга очень понравилась, читать было интересно и даже страшно, сразу вспомнилось детство, где ночью виделись призраки, бандиты и покойники
Isais про Нури: Дочь ведьмы [СИ : Литрес] (Ужасы)
13 07 Старательно. По правилам. Неубедительно. Читал с полуночи до двух ночи, так и не проникся. Чего-то недоложили в этот борщевой набор. Пластмассово как-то. Оценка: неплохо
nik_ol про Луганцева: Чисто убойное дело [litres] (Иронический детектив, Детективы: прочее)
13 07 А что, Татьяна больше не пишет книжки?... Жду не дождусь новых, люблю читать перед сном и в транспорте, для разгрузки мозга! Оценка: отлично!
Wild_XC70 про Дроздов: Невеста инопланетянина (Альтернативная история, Космическая фантастика, Самиздат, сетевая литература)
12 07 Дождался проды. Лучше бы её не было. Похоже Дроздов перегорел. Оценка: плохо
mysevra про Каверин: Два капитана [с непрозрачными иллюстрациями] (Советская классическая проза, Приключения: прочее)
12 07 Поймала себя на том, что завидую главному герою. «Если вы думаете, что приключения опасны, попробуйте рутину – это смертельно». Оценка: отлично!
mysevra про Свечин: Выстрел на Большой Морской [litres] (Полицейский детектив, Исторический детектив)
12 07 Автор прекрасно ориентируется в датах, чинах и наградах, перечисляя их в восхитительном упоении. Неожиданно отзывается о правящей на тот момент династии. Да и вообще, как приключенческий роман, книги этой серии просто превосходны. ……… Оценка: хорошо |
Комментарии
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
Ну, я не специалист-филолог, но мне кажется, скрипт должен ориентироваться на литературный, а не на просторечный вариант.
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
В FBE есть проверка по словарю. "Орфография" F7 тыц. У поиска по набору регэкспов другая задача.
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
Не буду спорить. Свою задачу я вижу в том, чтобы набрать статистику. Что из нее учитывать, а что не учитывать, думаю должны решать разработчики.
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
Идеальный скрипт в любом случае не сделать.
Писалось выше - улучшить бы "Генеральную уборку".
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
Пока не вижу примеров для доработки скрипта, кроме прилипшего многоточия и удаления пробела перед маркером сноски.
Какие улучшения нужны?
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
А апостроф?
...предусмотреть замену всех возможных различных вариаций апострофов - ´ ʼ ′ ˙ ΄ - на ' (буква «э» на англ. раскладке), который U+0027.
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
V_E, вы, вообще, в курсе, что пробел и нижнее подчеркивание, это разные символы?
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
Прошу прощения, но не совсем понял, в связи с чем возник этот вопрос? Если ответить коротко - да, в курсе, но, по-моему, про нижнее подчеркивание я ничего не писал? И на его проверку не жаловался. Может, конечно, что-то запамятовал, уточните, если не сложно, почему вы меня об этом спрашиваете.
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
V_E, потому что во многих ваших книгах, загруженных сюда, в названии книги вместо пробелов стоят нижние подчеркивания.
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
Можно попросить ссылку? И уточните, о чем идет речь: о названии книги (печатное издание) или имени файла? Нижнее подчеркивание использую в имени файла. Это давняя привычка, обусловленная определенными причинами. А вот в названии книги - что-то за собой такого не помню. Если дадите ссылку, проверю по своим оригиналам. Может быть, это какая-то ошибка, тем более, что она есть "во многих файлах". Надо посмотреть, что это такое.
RE:Обновление скрипта "Поиск по набору регэкспов" для FBE -...
Теперь еще по поводу работы скрипта, столкнулся с моментами, вызвавшими легкое удивление:
скрипт иногда обнаруживает, а иногда пропускает полужирное начертание отдельной буквы предлог "и", местоимение "я". Удивило, что иногда полужирное начертание обнаруживается, а иногда нет. Может, конечно, он реагирует на что-то иное, совпадающее с полужирным начертанием.
Также пропускает сочетание ., (точка и запятая). Также пропускает слово нащ (должно быть - наш). Но это, видимо, тоже относится к орфографическим ошибкам, которые скрипт не проверяет?
Добавлено позже:
Обрабатывал скриптом книгу, в которой при распознавании был пропущены все дефисы в словах типа как-то, кто-то кто-либо, когда-либо и т.д. Заметил, что скрипт пропускает словосочетание дватри (два-три); и тотмто (том-то в выражении "в том-то и дело")
Страницы