27 Beitrag/Beiträge
Mittwoch, 17. Juni 2026
Nach der Build habe ich mir den Teil vorgenommen, der mich wirklich betrifft: Wie sieht ein Agent aus, der vor einer schreibenden Aktion fragt?
Weiterlesen...Dienstag, 16. Juni 2026
Weil hinter IChatClient beides steckt, lässt sich ein Ausweichweg bauen:
Weiterlesen...Mittwoch, 10. Juni 2026
Die Build ist durch, und wie jedes Jahr stellt sich die Frage, was davon für Leute übrigbleibt, die keine Plattform betreiben, sondern Anwendungen bauen.
Weiterlesen...Mittwoch, 20. Mai 2026
Die unangenehmste Stelle beim Arbeiten mit Sprachmodellen ist die Rückgabe. Man bittet um JSON, bekommt JSON, und beim vierzigsten Aufruf steht davor „Gerne! Hier ist das JSON:” und das Ganze in einem Markdown-Block.
Weiterlesen...Mittwoch, 06. Mai 2026
Die beiden Stränge der letzten Wochen treffen sich hier: ein MCP-Server in C# und ein lokal laufendes Modell. Statt mich per SSH durch drei Maschinen zu klicken, frage ich, was los ist.
Weiterlesen...Montag, 04. Mai 2026
Ollama hält ein Modell nach dem letzten Aufruf noch eine Weile im Speicher. Was gerade liegt:
Weiterlesen...Donnerstag, 30. April 2026
Awesome Selfhosted. Eine Liste, die man nicht durchliest, sondern durchsucht, wenn man für ein Problem etwas Selbstgehostetes sucht. Hat mir zweimal einen Dienst erspart, den ich sonst selbst gebaut hätte.
Weiterlesen...Donnerstag, 23. April 2026
Weil hinter IChatClient beides stecken kann, lässt sich ein Vergleich in wenigen Zeilen bauen:
Weiterlesen...Dienstag, 21. April 2026
Beim RAG-Beitrag kamen die Embeddings noch aus der Cloud. Lokal geht es genauso, und zwar deutlich unkritischer als bei Sprachmodellen:
Weiterlesen...Montag, 20. April 2026
Die häufigste Enttäuschung beim ersten Versuch mit lokalen Modellen: Man lädt etwas herunter, es startet, und dann antwortet es mit zwei Wörtern pro Sekunde. Das liegt fast immer daran, dass das Modell nicht in den Grafikspeicher passt.
Weiterlesen...