brommbytes Login
zuletzt aktualisiert: 16. Aug 2026

Ich baue KI-Agenten und erzähle, was in der Praxis wirklich funktioniert – und was nicht.

Keine großen Versprechen und kein Prompt-Geflüster. Jeder Beitrag entsteht aus einem Projekt, das ich selbst umgesetzt habe, inklusive Code, Messwerten und den Fehlern, die dabei passiert sind.

Lokale LLMs vs. API: Rechnet sich der eigene KI Server?

Bei 30 cent/kWh und Streaming-Preisen liegt der Break-even zwischen lokalem LLM-Betrieb und API bei rund 3,9 Millionen generierten Tokens pro Tag.

lesen
Aus den Logs
2
Posts seit 2024
$340
teuerster Agent-Loop
38%
Kosten runter, Kap. 12
0
gesponserte Posts
Newsletteralle zwei Wochen, ein Post

Alle Posts

Lokale LLMs auf 48 GB VRAM: Welche Modelle wirklich schnell laufen

Ein praktischer llama.cpp-Benchmark auf zwei GPUs — mit reproduzierbarer Methodik, Messwerten und einer vorsichtigen Einordnung für lokale KI-Agenten.

tooling 12. Aug 2026 · 11 min