Beiträge zum Thema „KI“

27 Beitrag/Beiträge

Ein Agent, der vorher fragt

Mittwoch, 17. Juni 2026

Nach der Build habe ich mir den Teil vorgenommen, der mich wirklich betrifft: Wie sieht ein Agent aus, der vor einer schreibenden Aktion fragt?

Weiterlesen...

Lokales Modell als Ausweichlösung

Dienstag, 16. Juni 2026

Weil hinter IChatClient beides steckt, lässt sich ein Ausweichweg bauen:

Weiterlesen...

Build 2026, aus der Ferne betrachtet

Mittwoch, 10. Juni 2026

Die Build ist durch, und wie jedes Jahr stellt sich die Frage, was davon für Leute übrigbleibt, die keine Plattform betreiben, sondern Anwendungen bauen.

Weiterlesen...

Wenn das Modell JSON liefern soll

Mittwoch, 20. Mai 2026

Die unangenehmste Stelle beim Arbeiten mit Sprachmodellen ist die Rückgabe. Man bittet um JSON, bekommt JSON, und beim vierzigsten Aufruf steht davor „Gerne! Hier ist das JSON:” und das Ganze in einem Markdown-Block.

Weiterlesen...

Ein MCP-Server für das eigene Homelab

Mittwoch, 06. Mai 2026

Die beiden Stränge der letzten Wochen treffen sich hier: ein MCP-Server in C# und ein lokal laufendes Modell. Statt mich per SSH durch drei Maschinen zu klicken, frage ich, was los ist.

Weiterlesen...

Welches Modell liegt gerade im Speicher?

Montag, 04. Mai 2026

Ollama hält ein Modell nach dem letzten Aufruf noch eine Weile im Speicher. Was gerade liegt:

Weiterlesen...

Gelesen im April

Donnerstag, 30. April 2026

Awesome Selfhosted. Eine Liste, die man nicht durchliest, sondern durchsucht, wenn man für ein Problem etwas Selbstgehostetes sucht. Hat mir zweimal einen Dienst erspart, den ich sonst selbst gebaut hätte.

Weiterlesen...

Zwei Modelle im Test gegeneinander

Donnerstag, 23. April 2026

Weil hinter IChatClient beides stecken kann, lässt sich ein Vergleich in wenigen Zeilen bauen:

Weiterlesen...

Embeddings lokal erzeugen

Dienstag, 21. April 2026

Beim RAG-Beitrag kamen die Embeddings noch aus der Cloud. Lokal geht es genauso, und zwar deutlich unkritischer als bei Sprachmodellen:

Weiterlesen...

Welches lokale Modell läuft auf welcher Hardware?

Montag, 20. April 2026

Die häufigste Enttäuschung beim ersten Versuch mit lokalen Modellen: Man lädt etwas herunter, es startet, und dann antwortet es mit zwei Wörtern pro Sekunde. Das liegt fast immer daran, dass das Modell nicht in den Grafikspeicher passt.

Weiterlesen...

« Zurück zur Startseite