# Nur fuer embeddings.py. # # transformers und nicht sentence-transformers: letzteres zieht scipy und # scikit-learn nach (rund 60 MB), die hier nichts tun, und kapselt genau die # Stelle weg, auf die es ankommt - das Auffuellen der Stapel. Mittelwert und # L2-Normierung sind zwei Zeilen; die Kontrolle ueber die feste Tokenlaenge # ist die Reproduzierbarkeit wert (siehe embeddings.MAX_TOKEN). transformers