Docker Compose als Linux-Dienst mit systemd ausführen

Docker Compose als Linux-Dienst mit systemd ausführen

Docker Compose beim Systemstart, verwaltet durch systemd.

Ein Docker Compose-Projekt auf einem Linux-Server sollte beim Booten starten, beim Herunterfahren sauber gestoppt werden und Neustarts ohne manuelle Eingriffe überstehen.

Spekulative Dekodierung: 20–50 % schnellere LLM-Inferenz

Spekulative Dekodierung: 20–50 % schnellere LLM-Inferenz

Schnellere LLM-Inferenz ohne Qualitätsverlust – eine praktische Anleitung

Ein 70B-Modell erzeugt pro Vorwärtsdurchlauf (Forward Pass) genau ein Token, und bei jedem Durchlauf werden Gewichte aus dem VRAM nachgeladen, die Aufmerksamkeit (Attention) über den Kontext berechnet und der Speicher synchronisiert. Zwischen den Tokens ist die GPU untätig, während sie auf die Auflösung sequentieller Abhängigkeiten wartet.

Multi-Agent-Orchestrierungsmuster: Ein praktischer Leitfaden

Multi-Agent-Orchestrierungsmuster: Ein praktischer Leitfaden

40 % der Multi-Agent-Pilotprojekte scheitern. So wählen Sie das richtige Orchestrierungsmuster – und vermeiden diejenigen, die scheitern.

Die Ära der Single-Agent-AI-Systeme erreichte 2025 ihren Höhepunkt — man gab einem LLM (Large Language Model) einen Prompt, einige Werkzeuge und ein Ziel, und es bewältigte begrenzte Aufgaben recht gut.

Das Transactional-Outbox-Muster in Go mit PostgreSQL

Das Transactional-Outbox-Muster in Go mit PostgreSQL

Schreiben Sie das Event mit den Daten. Teilen Sie diese niemals auf.

Zwei Schreibvorgänge, die gemeinsam erfolgreich sein sollten, werden sich im Laufe der Zeit separat fehlschlagen.

Ihr Order-Service speichert die Bestellung in der Datenbank und veröffentlicht anschließend ein order.created-Ereignis an einen Message Broker.

Entscheidungsprotokolle für die KI-gestützte Softwareentwicklung

Entscheidungsprotokolle für die KI-gestützte Softwareentwicklung

Halten Sie die Absicht nah am Code.

Entscheidungsdokumente sind die fehlende Speicherschicht in der KI-gestützten Softwareentwicklung. Sie erfassen nicht nur, was gebaut wurde, sondern auch warum – und diese Unterscheidung wird entscheidend, wenn KI-Tools Ihren Code schreiben.

Testen von gleichzeitigem Go-Code mit synctest

Testen von gleichzeitigem Go-Code mit synctest

Vermeiden Sie unnötiges Warten in parallelen Go-Tests.

Das Testen von parallelem Go-Code erforderte bisher stets eine gewisse Disziplin. Goroutinen sind günstig, Channels sind einfach und die Kontextabsage ist idiomatisch – Hintergrundarbeiter und Timer sind in echten Go-Diensten allgegenwärtig.

Abonnieren

Neue Beiträge zu Systemen, Infrastruktur und KI-Engineering.