Embeddings lokal erzeugen

Embeddings lokal erzeugen

- Matt

Beim RAG-Beitrag kamen die Embeddings noch aus der Cloud. Lokal geht es genauso, und zwar deutlich unkritischer als bei Sprachmodellen:

ollama pull nomic-embed-text
IEmbeddingGenerator<string, Embedding<float>> generator =
    new OllamaApiClient(new Uri("http://homelab:11434"), "nomic-embed-text");

var vektor = await generator.GenerateVectorAsync("Rechnung stornieren");

Embedding-Modelle sind klein, meist unter 500 MB, und laufen auch ohne Grafikkarte flott. Für ein paar tausend Dokumente ist das eine Sache von Minuten.

Wichtig: Die Dimension muss zum Vektorspeicher passen. nomic-embed-text liefert 768 statt der 1536 von OpenAI. Wer das Modell wechselt, muss alles neu einbetten, ein Mischbetrieb ergibt Unsinn.