extr.py 6.3 KB

123456789101112131415161718192021222324252627282930313233343536373839404142434445464748495051525354555657585960616263646566676869707172737475767778798081828384858687888990919293949596979899100101102103104105106107108109110111112113114115116117118119120121122123124125126127128129130131132133134135136137138139140141142143144145146147148149150151152153154155156157158159160161162163164165166167168169170171172173174175176177178179180181182183184185186187188189190191192193194195196197198199200201202203204205206207208209210211212213
  1. #!/home/moi/ProtoMemoires/venv/bin/python
  2. # de docx ou odt ver LaTeX
  3. #
  4. import sys,pypandoc,os,re,subprocess,yaml,hashlib
  5. #---------------------------------------------
  6. sys.path.append(f"{os.getcwd()}/..")
  7. from memmod import *
  8. #----
  9. def fancyshort(s,t):
  10. # restreindre le texte de fancyhead (s est le nom, t le titre,
  11. # qu'il faut éventuellement racourcir pour qu'il tienne sur une seule
  12. # ligne.
  13. #
  14. # s (le nom de l'orateur, par exemple) est toujours affiché.
  15. # t est éventuellement raccourci.
  16. #
  17. limit =75 #taille max en caratères
  18. if len(s+t)<limit:
  19. return s,t
  20. else:
  21. tl=t.split()
  22. tl.pop()
  23. while sum(len(x) for x in tl)>limit:
  24. tl.pop()
  25. return s, " ".join(tl)+"\\ldots"# pointillés à la fin.
  26. def star_sec(l):
  27. # \section est transformée en \section* et on ne garde comme argument
  28. # que ce qui est nécessaire.
  29. it=iter(L)
  30. ret=[]
  31. passed= False
  32. for x in it:
  33. if "begin{document" in x:
  34. passed= True
  35. if passed and "section[" in x:
  36. s=x
  37. while "label" not in x:
  38. x=next(it)
  39. s=s+" "+x
  40. if not "}" in s:
  41. x=next(it)
  42. s=s+x
  43. k=s.find("]")
  44. r=(s[:k]+"}").replace("[","*{")+" "
  45. ret.append(r)
  46. ret.append("\n")
  47. else:
  48. ret.append(x)
  49. return ret
  50. #---------------------------------------------------------------------
  51. # ligne de command [nocompile]
  52. #
  53. # nocompile pour ne pas compiler
  54. #
  55. #
  56. compile= not "nocompile" in sys.argv
  57. #-----------------------------------------------------------------------
  58. # Construire le titre à partir du fichier data.yml.
  59. #-----------------------------------------------------------------------
  60. #---clés du fichier data.yml
  61. data_yml_mandatory_keys=['fichier', 'date', 'auteur', 'titre']
  62. data_yml_order=['date','type','auteur','statut','titre']
  63. #
  64. with open("data.yml") as f:
  65. lt=yaml.safe_load(f)
  66. print("data_yml lu")
  67. # on vérifie que le fichier "data.yml" est correct:
  68. for x in data_yml_mandatory_keys: #vérifier la présence des clés obligatoires
  69. if not x in lt.keys():
  70. raise Exception(f"\n\n Il manque la clé {x} dans data.yml\n\n")
  71. # si statut est défini, type doit l'être aussi:
  72. if "statut" in lt.keys(): # membre t=itulaire, correspondant, d'honneur...
  73. if "type" not in lt.keys():
  74. raise Exception(f"\n\n statut est défini, mais pas type\n\n")
  75. #
  76. add_virgule = True
  77. else: # si statut n'est pas défini, on le définit à " " et type à "Conférence".
  78. add_virgule =False
  79. lt["statut"]=" "
  80. if "type" not in lt.keys():
  81. lt["type"]="Conférence"
  82. print("data.yml analysé")
  83. # ---les paramètres:
  84. auteur= lt["auteur"]
  85. titre= lt["titre"]
  86. label=dolabel(auteur,titre)
  87. if add_virgule:
  88. auteur=auteur+","
  89. lt["auteur"] = auteur
  90. # biblio ?
  91. has_bib= "biblio"in lt.keys()
  92. if has_bib:
  93. if len(lt["biblio"].split()) ==2:
  94. bibfile= lt["biblio"].split()[0]
  95. citeall = lt["biblio"].split()[1] == "citeall"
  96. else:
  97. bibfile= lt["biblio"]
  98. citeall=False
  99. #-------------------------------------------------
  100. #
  101. # le fichier (docx, odt) qu'on va traiter:
  102. #
  103. fich=lt["fichier"].strip()
  104. #
  105. # fabriquer le titre à partir des données yml
  106. #
  107. titre_elements="}{".join([lt[x].replace("\n","") for x in data_yml_order])
  108. s,t=fancyshort(lt['auteur'],lt['titre'])
  109. titre_elements= titre_elements+"}{"+t
  110. le_titre= f"\\titre{{{titre_elements}}}\n"
  111. #--------------------------------------------------------------------
  112. template=sys.path[0]+"/tpl.tex" # le template
  113. #---------------------------------------------------------------------
  114. exten=fich.split(".")[-1]
  115. #
  116. # Traitement du fichier source
  117. # ---------------------------
  118. if exten=="docx" or exten=="odt":
  119. futurTex= fich.replace(exten,"tex")
  120. else:
  121. s=f"\n{fich} : extension incorrecte"
  122. raise Exception(s)
  123. #répertoire pour les images
  124. images= fich.split(".")[0]+"-media"
  125. print("Répertoire des images : ",images)
  126. if not os.path.isdir(images):
  127. os.mkdir(images)
  128. #
  129. # conversion en latex
  130. #
  131. extra_args= ["-s",f"--template={template}",f"--extract-media={images}"]
  132. #extra_args= ["-s",f"--template={template}",f"--extract-media={images}",
  133. # f"--lof=true"]
  134. L = pypandoc.convert_file(fich, 'tex',
  135. extra_args=extra_args).splitlines()
  136. #-----------------------------------------------------------------------
  137. # section -> section*
  138. rechsec= r"section[{\[]"
  139. rechsecc=re.compile(rechsec)
  140. # pour modifier le latex en changeant le chemin vers les images.
  141. if exten=="docx":
  142. rechgra=r"includegraphics\[.*\]{media.*}"
  143. repPath=("media",f"{images}/word/media")
  144. elif exten=="odt":
  145. rechgra=r"includegraphics\[.*\]{Pictures.*}"
  146. repPath=("Pictures",f"{images}/Pictures")
  147. rechgrac=re.compile(rechgra)
  148. #
  149. # On crée le fichier LaTex
  150. #
  151. with open(futurTex,"w") as f:
  152. L1=star_sec(L)
  153. rp0,rp1= repPath
  154. for l in L1:
  155. if has_bib and "addbibresource{}" in l:
  156. #bibfile=lt['biblio']
  157. l=l.replace("{","{"+bibfile)
  158. while (q:=rechgrac.search(l)) != None:
  159. l=l.replace(rp0,rp1)
  160. l=treatline(l)
  161. #
  162. if "@@fin" in l:
  163. if has_bib:
  164. #f.write("\\begin{center}\\textbf{Bibliographie}\\end{center}\n")
  165. #f.write("\\citeall[\\fullcite]\n")
  166. f.write("\\section*{Bibliographie}")
  167. if citeall:
  168. f.write(nocite_all(bibfile)+"\n")
  169. f.write("\\printbibliography[heading=none]\n")
  170. f.write("\\FloatBarrier\n")
  171. f.write("\\end{refsection}\n")
  172. f.write(l)
  173. f.write("\n")
  174. if "@@debut" in l:
  175. f.write("\\begin{refsection}\n")
  176. f.write("\\fancyhead{}\n")
  177. f.write("\\fancyhead[CE]{Mémoires: 2\\ieme{} partie}\n")
  178. #f.write(f"\\fancyhead[CO]{{{s} {t}}}\n")
  179. f.write(le_titre)
  180. f.write(f"\\label{{{label}}}\n")
  181. #
  182. #---fin d'éciture du fichier tex
  183. #
  184. # lualatex, 2 fois si pas de bib, 3 fois + biber sinon:
  185. #
  186. if compile:
  187. subprocess.run(["/usr/bin/lualatex", futurTex])
  188. if has_bib:
  189. subprocess.run(["/usr/bin/biber", futurTex.replace(".tex","")])
  190. subprocess.run(["/usr/bin/lualatex", futurTex])
  191. subprocess.run(["/usr/bin/lualatex", futurTex])
  192. #--- fin