Вы здесьПроверка валидности fb2-файла при загрузке ???
Опубликовано ср, 27/08/2008 - 05:42 пользователем Ghost mail
Forums: Сложно ли добавить автоматическую проверку валидности книг перед их загрузкой на сайт и "не пропускать" невалидные файлы ???
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
DGOBLEK RE:Подайте бедному копеечку на книжку с литреса... 22 часа
sem14 RE:«Не забыть бы тогда, не простить бы и не потерять!»-2 ... 1 день sem14 RE:Серия "Очень прикольная книга", издательство Азбука-классика 2 дня sem14 RE:Серия "Я познаю мир" издательства "АСТ, Астрель, Олимп",... 2 дня larin RE:Заблокирован 1 неделя alexk RE:Прошу переформатировать, распознать, etc... 1 неделя konst1 RE:Серия «Интеллектуальный детектив» изд-ва АСТ 3 недели Larisa_F RE:Серия книг «Судьбы книг» издательства «Книга» 3 недели fixel RE:Пропал абонемент 3 недели sem14 RE:Книжная серия "Жизнь в искусстве" издательство "Искусство"... 1 месяц sibkron RE:"100 славянских романов", серия изд.-ва "Центр книги... 1 месяц Larisa_F RE:Серия "Новые сказочные повести" издательство "Самовар" ... 2 месяца sem14 RE:Серия "Символы времени" издательства "Аграф" 2 месяца tvv RE:faq brainstorm =) 2 месяца Larisa_F RE:Серия "Что есть что" издательства "Слово"(чего не хватает) 2 месяца larin RE:абонемент не обновлен 2 месяца sem14 RE:За иллюминатором (серия) - чего не хватает? 2 месяца sem14 RE:Собираем серию: "Мастер серия", издательство "Лимбус". 2 месяца Впечатления о книгах
francuzik про Москаленко: Маг. Книга 1 [СИ] (Фэнтези, Боевик, Самиздат, сетевая литература)
12 04 Не советую. Полный отстой. До этого автор писал более менее на троечку. Тут же не знаю что и думать. Может случилось что? Оценка: нечитаемо
Дей про Мастер Трав
12 04 На данный момент есть 5 книг. Я так-то предпочитаю подобные произведения для расслабления: атмосфера PW, WOW, вот это копание травок, рост в навыках. И совершенно не хочется, блин, превозмогания. А здесь ГГ буквально утыкан ………
mysevra про Толстой: Семейное счастие (Русская классическая проза)
12 04 Уф. Столько слышала восторгов об этой повести: ах, мол, история удивительной трансформации любви. Как по мне, неравный брак: мужчина лет на 20 старше жены, со своими сложившимися взглядами на жизнь, лепит из ничего не видевшей ……… Оценка: хорошо
mysevra про Твардовский: Василий Тёркин (О войне, Поэма, эпическая поэзия)
12 04 Интересный слог, легко читается и западает в память. Смесь нарочитой простоты и оптимизма – убойное сочетание! Правда, со временем эта простота и однообразнось приедаются, но уважение к автору остаётся. Оценка: отлично!
mysevra про Баркер: Каньон Холодных Сердец [litres] (Ужасы, Мистика)
12 04 Если бы немного ускорить процесс… Первая часть, совсем крошечная, как бы вступительная, была интригующей, а дальше хотелось пролистывать. Вроде бы и ладно написано, и подробности в тему, просто особенности склок и страданий ……… Оценка: неплохо
Skyns71 про Поселягин: На просторах неизвестной планеты [litres] (Боевая фантастика, Попаданцы)
11 04 Какой-то жутко беспомощный, коряво написанный текст - словно сочинение не самого умелого школьника... Ну как такое ухитрились издать? Вероятно, сработала немотивированая злоба автора в адрес американцев, лезущая аж на третьей странице. Оценка: нечитаемо
Евгений11112 про Иторр: Повелитель Теней [= Книга Теней] (Фэнтези)
11 04 Прочитал очень давно, до сих пор помню, а значит неплохо. Такое впечатление, что написано было под приходом. Оценка: отлично!
Oleg68 про Иванов: Тобол. Много званых [litres] (Современная проза, Исторические приключения)
10 04 Хорошая книга, но "Сердце Пармы" и "Золото бунта, или Вниз по реке теснин" мне понравились больше. Оценка: хорошо
Дей про Сластин: Кодекс Практика: Страница 1 (Героическая фантастика, Фэнтези, Попаданцы, ЛитРПГ, Самиздат, сетевая литература)
10 04 Мало кто любит читать о героях, которым всё само падает в руки. Но когда ГГ такой нытик, растяпа и дурак, как этот, читать не хочется ещё больше. Реально, всю книгу от только ноет и косячит, косячит и ноет. Оценка: плохо
Oleg68 про Эндрюс: Икар [Icarus ru] (Триллер)
07 04 Отличный триллер. В напряжении держит до последних страниц. Очень неожиданный главный злодей и непредсказуемый финал. Оценка: отлично!
decim про Горан Скробонья
07 04 Всё замазано серым. Снова привычные "уставился", ну куда без них. Словно гуглопер с посредственного английского перевода. Может быть в оригинале это интересно, а так - плохо. ЗЫ, в послужном списке транслейтора ещё есть ………
Irsanta про Данияр Саматович Сугралинов
06 04 Интересно. «Бывает и хуже» Алмазова и «22 несчастья» Сугралинова с одного образца писались? |
Отв: Проверка валидности fb2-файла при загрузке.
Сложно ли вам, Ghost mail, указать в своем сообщении утилиту для "проверки валидности" fb2, которую вы предлагаете ???
Отв: Проверка валидности fb2-файла при загрузке.
Однако, эти редакторы-утилиты для работы с командной строки, а нужна проверка на php, которая бы работала на веб-сервере перед загрузкой файла книги.
В-действительности, прежде всего этот вопрос нужно решить "политически" - нужно или не нужно 8-)
Мое личное мнение,- нужно. Лучше пусть будет немного меньше книг, но они будут "качественнее" (будут соответствовать стандарту FB2)
Отв: Проверка валидности fb2-файла при загрузке.
Предлагаете "прикрутить" FBE? Или fb2fix? :)
Идеально "валидных" fb2-файлов на сегодня не существует, как и программы, которая бы это определяла - и все благодаря "стандарту FB2". За работой скриптов приходится убирать вручную, валидность книги - определять "на глазок".
От "политического" решения ничего не изменится - кроме громких фраз: программа не появится, вычитка файлов не улучшится. Кроме того, найдя незакрытый тег в fb2-книге - гораздо легче его закрыть, чем брезгливо отбросить этот файл и отсканировать книгу по-новой.
Отв: Проверка валидности fb2-файла при загрузке ???
И файл может быть невалидным, но содержать полный текст, и другого в библиотеке может не быть. Невалидность мы поправим.
Отв: Проверка валидности fb2-файла при загрузке ???
Не пропускать невалидные файлы - это вряд ли реально нужно, а вот некая пометка, позволяющая невалидников обнаружить - не помешала бы.
Отв: Проверка валидности fb2-файла при загрузке ???
А кто-нибудь более-менее формально описать процедуру валидации может?
Разобрать XML, проверить возможность тэгов и словарно-кодируемых полей?
Всё?
Если всё, я в свой скрипт могу это добавить (XML-разбор там уже есть)...
Он, правда, не на ПХП, а на Питоне, но не думаю, что это нынче проблема для большинства хостингов.
Отв: Проверка валидности fb2-файла при загрузке ???
Формализовать процедуру "исправления" невалидного файла, чтобы он стал валидным, почти невозможно. Можно только пытаться проверять и исправлять набор часто встречаемых ошибок (как-то : неправильный порядок тегов 'title' и 'epigraph'; тег 'title' в середине текста; оформление стихов в тексте тегом 'epigraph' и так далее).
Однако задавая вопрос в теме топика я имел в виду : проверять валидность перед загрузкой на сервер и в случае ошибок,- сообщать пользователю об этом и не загружать невалидный файл. Подразумевается, что после этого пользователь потратит еще 1-2 минуту на исправление своего файла, и загрузит этот файл исправленным 8-)
Отв: Проверка валидности fb2-файла при загрузке ???
>тег 'title' в середине текста
А это из чего следует что невалидно? это допускает схема, и, более того, явно присуствует в примерах на fictionbook.org.
Это какой-то тогда не XML уже получается, а некий формат издалека напоминающий XML :-)
Отв: Проверка валидности fb2-файла при загрузке ???
title должно быть в начале секции. Это переводится как заголовок, если вы не в курсе. В середине секции title быть не может.
Правильно:
<section>
<title></title>
<p></p>
<p></p>
</section>
Не правильно:
<section>
<p></p>
<title></title>
<p></p>
</section>
Отв: Проверка валидности fb2-файла при загрузке ???
Отв: Проверка валидности fb2-файла при загрузке ???
Проверка валидности очень не помешала бы.
В некоторых файлах, (в них сказано что сделаны они в "LibRusEc kit") пометки, сноски, перевод разных понятий заключены в знаки < >,хотя по спецификации XML они должны быть в виде
< >соответственно, также иногда попадается знак & (амперсанд) хотя и он должен быть написан не прямо, а специально вот так&Из-за таких нарушений формата разметки XML некоторые файлы не возможно читать программами которые четко следуют спецификации XML
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
Проверка валидности при загрузке fb2-файлов от автора "LibRusEc kit" - хорошая шутка, спасибо :)
Если серьезно - дайте ссылки на книги, а еще лучше - давайте исправим их вместе.
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
Я могу сгенерить список. Только, боюсь, в нем будет несколько десятков тысяч (не несколько тысяч, а несколько десятков тысяч) книг. И што мы будем с ими делать?
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
Точнее, 47 642 : http://lib.rus.ec/stat/document-author .
Проверить на другие варианты файла - скачать - открыть - поиск символов с автозаменой - сохранить - залить на Либрусек.
repeat
Всего по 23 821 на рыло.
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
:) Да, рыла могут треснуть.
На самом деле немножко меньше: у меня готовятся что-то в районе четырех тысяч книг с Алдебарана/Литреса, которые будут заменой Либрусек-Киту. Но пока никак не приспособлюсь чтобы залить их без ручных разборок с дублями... :((
С другой стороны - супротив 47-ми тысяч оно не то чтобы совсем уж мертвому припарки... но и ненамного больше.