29 Beitrag/Beiträge
Dienstag, 21. April 2026
Beim RAG-Beitrag kamen die Embeddings noch aus der Cloud. Lokal geht es genauso, und zwar deutlich unkritischer als bei Sprachmodellen:
Weiterlesen...Montag, 20. April 2026
Die häufigste Enttäuschung beim ersten Versuch mit lokalen Modellen: Man lädt etwas herunter, es startet, und dann antwortet es mit zwei Wörtern pro Sekunde. Das liegt fast immer daran, dass das Modell nicht in den Grafikspeicher passt.
Weiterlesen...Donnerstag, 16. April 2026
Wenn man ein lokales Modell immer mit demselben Systemprompt benutzt, gehört der nicht in den Code:
Weiterlesen...Mittwoch, 15. April 2026
Der angenehmste Nebeneffekt der IChatClient-Abstraktion ist, dass ein lokales Modell dahinter genauso aussieht wie ein entferntes. Das macht den Versuch billig.
Weiterlesen...Montag, 13. April 2026
Während ich im Urlaub war, ist das Microsoft Agent Framework in Version 1.0 erschienen. Damit ist die Zusammenführung von AutoGen und Semantic Kernel abgeschlossen.
Weiterlesen...Donnerstag, 12. März 2026
Vor ziemlich genau einem Jahr habe ich den ersten MCP-Server in C# gebaut, damals mit einem SDK in Vorabversion und der Vermutung, dass sich das durchsetzen könnte. Zeit für eine Zwischenbilanz.
Weiterlesen...Donnerstag, 05. Februar 2026
Wer im letzten Jahr Agenten in .NET bauen wollte, stand vor der Wahl zwischen Semantic Kernel und AutoGen, wobei beide von Microsoft kamen und beide dasselbe Problem lösen sollten. Diese Doppelung ist jetzt beendet: Das Microsoft Agent Framework führt beide zusammen und hat den Release Candidate erreicht.
Weiterlesen...Donnerstag, 04. Dezember 2025
Vor drei Jahren habe ich hier über ChatGPT geschrieben und die Frage im Titel offen gelassen, ob das ein Hype sei. Zeit für eine ehrlichere Antwort, denn inzwischen benutze ich diese Werkzeuge täglich.
Weiterlesen...Dienstag, 16. September 2025
Bei klassischem Code beantwortet ein Test die Frage, ob eine Änderung etwas kaputt gemacht hat. Bei einem Prompt gibt es diese Sicherheit nicht. Man formuliert um, probiert drei Fragen durch, findet die Antworten irgendwie besser und schiebt es live. Zwei Wochen später meldet jemand einen Fall, der vorher funktioniert hat.
Weiterlesen...Dienstag, 15. Juli 2025
Ein Sprachmodell kennt die eigene Dokumentation nicht. Der übliche Ausweg heißt RAG: Man sucht vorab die passenden Textstellen heraus und legt sie dem Modell mit in den Prompt. Der Teil, der dabei Arbeit macht, ist die Suche, denn sie soll nach Bedeutung finden und nicht nach Zeichenketten.
Weiterlesen...