Вход fb2 и метаданные цикла в EPUB

fb2html.py — третий вход в конвейер. FB2 в домашней библиотеке основной формат
(704 тысячи файлов), и без него конвейер до них не дотягивался. Разметка fb2
семантическая, поэтому задача та же, что у epub2html.py: свести чужие теги к
нашим. Уровень заголовка берётся из вложенности section.

pack_epub.py: --series и --series-index. Пишутся в двух видах — calibre-совместимый
meta понимают почти все читалки, belongs-to-collection требует EPUB 3. Без них
читалка не выстраивает книги цикла по порядку.
This commit is contained in:
chesirecatt
2026-08-21 19:45:37 +03:00
parent 43d6cfc456
commit f19410d9ce
2 changed files with 187 additions and 3 deletions
+24 -3
View File
@@ -48,6 +48,23 @@ def split_chapters(lines):
return [(t, b) for t, b in chapters if any(x.strip() for x in b)]
def series_meta(meta):
"""Цикл и номер в нём. Пишем в двух видах: calibre-совместимый meta читают
почти все читалки, belongs-to-collection — требование EPUB 3."""
name = meta.get("series")
if not name:
return ""
idx = meta.get("series_index") or ""
out = ['\n <meta name="calibre:series" content="%s"/>' % html.escape(name)]
if idx:
out.append('<meta name="calibre:series_index" content="%s"/>' % html.escape(str(idx)))
out.append('<meta property="belongs-to-collection" id="c01">%s</meta>' % html.escape(name))
out.append('<meta refines="#c01" property="collection-type">series</meta>')
if idx:
out.append('<meta refines="#c01" property="group-position">%s</meta>' % html.escape(str(idx)))
return "\n ".join(out)
def build(src, out, meta):
text = src.read_text(encoding="utf-8")
css = re.search(r"<style>(.*?)</style>", text, re.S)
@@ -107,12 +124,12 @@ def build(src, out, meta):
<dc:identifier id="bid">%s</dc:identifier>
<dc:title>%s</dc:title>
<dc:creator>%s</dc:creator>
<dc:language>%s</dc:language>
<dc:language>%s</dc:language>%s
</metadata>
<manifest>%s</manifest>
<spine toc="ncx">%s</spine>
</package>""" % (html.escape(meta["id"]), html.escape(meta["title"]),
html.escape(meta["author"]), meta["lang"],
html.escape(meta["author"]), meta["lang"], series_meta(meta),
"\n ".join(items), "\n ".join(spine)))
nav = "\n".join(
@@ -136,9 +153,13 @@ def main():
ap.add_argument("--author", default="")
ap.add_argument("--lang", default="ru")
ap.add_argument("--cover", default="cover.jpg", help="имя файла в images/")
ap.add_argument("--series", default="", help="название цикла")
ap.add_argument("--series-index", default="", help="номер в цикле")
args = ap.parse_args()
meta = {"title": args.title, "author": args.author, "lang": args.lang,
"cover": args.cover, "id": "urn:uuid:" + args.output.stem.replace(" ", "-")}
"cover": args.cover, "series": args.series,
"series_index": args.series_index,
"id": "urn:uuid:" + args.output.stem.replace(" ", "-")}
n, imgs = build(args.source, args.output, meta)
size = args.output.stat().st_size / 2**20
print("%s: глав %d, картинок %d, %.1f МБ" % (args.output.name, n, imgs, size))