Вы здесьПроверка валидности fb2-файла при загрузке ???
Опубликовано ср, 27/08/2008 - 05:42 пользователем Ghost mail
Forums: Сложно ли добавить автоматическую проверку валидности книг перед их загрузкой на сайт и "не пропускать" невалидные файлы ???
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
Isais RE:Соседи 1 час
Саша из Киева RE:Подайте бедному копеечку на книжку с литреса... 12 часов babajga RE:Как сова отправилась в отпуск 4 дня Саша из Киева RE:Горящие паруса 1 неделя Саша из Киева RE:Подвиг героев - судьба страны. МНР: люди и годы 2 недели commodore RE:Письма 3 недели Саша из Киева RE:Три минуты истории 4 недели nehug@cheaphub.net RE:Как бы с этим побороться и побороть? 1 месяц Саша из Киева RE:Книги на латышском языке 1 месяц stevecepera RE:Список современных французских писателей? 1 месяц etorus2008 RE:Отв: Помогите найти книгу по описанию 1 месяц lemma7 RE:Чёрный нимб и другие истории, исполненные неизъяснимого ужаса 1 месяц Wedmak RE:Помогите найти!.. #2 1 месяц sem14 RE:Координация сканирования и вычитки 2 месяца babajga RE:Кто сможет раздобыть и оцифровать нужные мне книги? 2 месяца Isais RE:Мои открытия 2 месяца kopak RE:О группе Дятлова. О той самой, того самого... 2 месяца A5. RE:Не присылает пароль на почту 2 месяца Впечатления о книгах
voronin345 про Ежов: Перелетная птица (Социальная фантастика, Попаданцы, Самиздат, сетевая литература)
28 06 сочинение школьника пятого класса....как я нагну всех и мня не поставят в угол. Оценка: нечитаемо
mysevra про Бардуго: Правление волков [litres] [Rule of Wolves ru] (Героическая фантастика, Фэнтези, Городское фэнтези)
27 06 Хорошая работа переводчика, а сама история получилась тусклой. Зачем реанимировать то, что так хорошо упокоено? Найди себе нового идола. Оценка: неплохо
mysevra про Ищенко: Потусторонний криминал (Документальная литература, Научпоп)
27 06 В 90-е такая книга была бы откровением, в 2018 – слабенько, всё уже где-то читано. Оценка: неплохо
mysevra про Уланов: Плюс на минус (Детективная фантастика, Городское фэнтези)
27 06 Мне понравилось. Многие ругают авторов за незнание предмета. Какого, к чёрту, предмета? Справочника по содержанию русалок? Эта история не есть мануал рейнджера, это фольк-детектив, фэнтези и немножко мелодрама, призванная ……… Оценка: отлично!
Wik@Tor про Антиблицкриг
27 06 Встать я смог через три дня и, хоть и с трудом, доковылял до туалета. Счастья было полные штаны. Это как раз был Новый год. Силы понемногу прибывали. За прилавком молодая продавщица, как говорят, кровь с молоком, да с ………
voronin345 про Берг: Отдельный танковый [СИ] (Альтернативная история, Боевая фантастика, Самиздат, сетевая литература)
27 06 обожаю такую литературу. начало даже в анотации бодрит. ОБЫЧНЫЙ ДЕБИЛ. ПЕРЕЖИЛ ВСЕ В СОВКЕ. ПЕРЕНЕССЯ НА 2Ю МИРОВУЮ И СТАЛ ГЕРОЕМ! вот и вся книга. класс!!! Оценка: нечитаемо
dolle про Мусаниф: Травник (Боевая фантастика, Фэнтези, ЛитРПГ, Самиздат, сетевая литература)
26 06 Новые приключения в "мире физрука". Отлично. Оценка: отлично!
Drangool про Мах: Игра в умолчания (Боевая фантастика, Эпическая фантастика, Героическая фантастика, Фэнтези)
26 06 На мой взгляд - отлично! Понравилось и рекомендую! Оценка: отлично!
dolle про Лукьяненко: Седьмой (Киберпанк, Космическая фантастика, Попаданцы, Самиздат, сетевая литература)
26 06 Отлично. Первые тома серий у автора всегда хороши. Оценка: отлично!
Sello про Моруа: Голландия [Hollande ru] (Путешествия и география, География, путевые заметки)
26 06 Непонятно, отдельного издания этого произведеньица нет. Значит, входит в какой-то сборник, во всяком случае я не нашел в какой. Написано явно под конец его жизни, в 60-х. 50, а то и 60 лет прошло со времени написания, а Голландия, ……… Оценка: хорошо
Wik@Tor про Федин: Черный дембель. Часть 1 [СИ] (Альтернативная история, Попаданцы, Самиздат, сетевая литература)
25 06 Аннотация соответствует содержанию 2 книг, которые пролистал. Скучно и нудно. Оценка: плохо
decim про Александр Алексеевич Иванов (kopo6o4ka)
25 06 Лоли, император, смачное садомазо. Писнул и удовлетворён, читнул и облегчил... душу. Что попаданец тут в виде малолетней, да в альтернативной РИ, на то и квир. |
Отв: Проверка валидности fb2-файла при загрузке.
Сложно ли вам, Ghost mail, указать в своем сообщении утилиту для "проверки валидности" fb2, которую вы предлагаете ???
Отв: Проверка валидности fb2-файла при загрузке.
Однако, эти редакторы-утилиты для работы с командной строки, а нужна проверка на php, которая бы работала на веб-сервере перед загрузкой файла книги.
В-действительности, прежде всего этот вопрос нужно решить "политически" - нужно или не нужно 8-)
Мое личное мнение,- нужно. Лучше пусть будет немного меньше книг, но они будут "качественнее" (будут соответствовать стандарту FB2)
Отв: Проверка валидности fb2-файла при загрузке.
Предлагаете "прикрутить" FBE? Или fb2fix? :)
Идеально "валидных" fb2-файлов на сегодня не существует, как и программы, которая бы это определяла - и все благодаря "стандарту FB2". За работой скриптов приходится убирать вручную, валидность книги - определять "на глазок".
От "политического" решения ничего не изменится - кроме громких фраз: программа не появится, вычитка файлов не улучшится. Кроме того, найдя незакрытый тег в fb2-книге - гораздо легче его закрыть, чем брезгливо отбросить этот файл и отсканировать книгу по-новой.
Отв: Проверка валидности fb2-файла при загрузке ???
И файл может быть невалидным, но содержать полный текст, и другого в библиотеке может не быть. Невалидность мы поправим.
Отв: Проверка валидности fb2-файла при загрузке ???
Не пропускать невалидные файлы - это вряд ли реально нужно, а вот некая пометка, позволяющая невалидников обнаружить - не помешала бы.
Отв: Проверка валидности fb2-файла при загрузке ???
А кто-нибудь более-менее формально описать процедуру валидации может?
Разобрать XML, проверить возможность тэгов и словарно-кодируемых полей?
Всё?
Если всё, я в свой скрипт могу это добавить (XML-разбор там уже есть)...
Он, правда, не на ПХП, а на Питоне, но не думаю, что это нынче проблема для большинства хостингов.
Отв: Проверка валидности fb2-файла при загрузке ???
Формализовать процедуру "исправления" невалидного файла, чтобы он стал валидным, почти невозможно. Можно только пытаться проверять и исправлять набор часто встречаемых ошибок (как-то : неправильный порядок тегов 'title' и 'epigraph'; тег 'title' в середине текста; оформление стихов в тексте тегом 'epigraph' и так далее).
Однако задавая вопрос в теме топика я имел в виду : проверять валидность перед загрузкой на сервер и в случае ошибок,- сообщать пользователю об этом и не загружать невалидный файл. Подразумевается, что после этого пользователь потратит еще 1-2 минуту на исправление своего файла, и загрузит этот файл исправленным 8-)
Отв: Проверка валидности fb2-файла при загрузке ???
>тег 'title' в середине текста
А это из чего следует что невалидно? это допускает схема, и, более того, явно присуствует в примерах на fictionbook.org.
Это какой-то тогда не XML уже получается, а некий формат издалека напоминающий XML :-)
Отв: Проверка валидности fb2-файла при загрузке ???
title должно быть в начале секции. Это переводится как заголовок, если вы не в курсе. В середине секции title быть не может.
Правильно:
<section>
<title></title>
<p></p>
<p></p>
</section>
Не правильно:
<section>
<p></p>
<title></title>
<p></p>
</section>
Отв: Проверка валидности fb2-файла при загрузке ???
Отв: Проверка валидности fb2-файла при загрузке ???
Проверка валидности очень не помешала бы.
В некоторых файлах, (в них сказано что сделаны они в "LibRusEc kit") пометки, сноски, перевод разных понятий заключены в знаки < >,хотя по спецификации XML они должны быть в виде
< >
соответственно, также иногда попадается знак & (амперсанд) хотя и он должен быть написан не прямо, а специально вот так&
Из-за таких нарушений формата разметки XML некоторые файлы не возможно читать программами которые четко следуют спецификации XML
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
Проверка валидности при загрузке fb2-файлов от автора "LibRusEc kit" - хорошая шутка, спасибо :)
Если серьезно - дайте ссылки на книги, а еще лучше - давайте исправим их вместе.
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
Я могу сгенерить список. Только, боюсь, в нем будет несколько десятков тысяч (не несколько тысяч, а несколько десятков тысяч) книг. И што мы будем с ими делать?
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
Точнее, 47 642 : http://lib.rus.ec/stat/document-author .
Проверить на другие варианты файла - скачать - открыть - поиск символов с автозаменой - сохранить - залить на Либрусек.
repeat
Всего по 23 821 на рыло.
Отв: Проверка валидности fb2-файла от автора "LibRusEc kit".
:) Да, рыла могут треснуть.
На самом деле немножко меньше: у меня готовятся что-то в районе четырех тысяч книг с Алдебарана/Литреса, которые будут заменой Либрусек-Киту. Но пока никак не приспособлюсь чтобы залить их без ручных разборок с дублями... :((
С другой стороны - супротив 47-ми тысяч оно не то чтобы совсем уж мертвому припарки... но и ненамного больше.