Blog

Alle Beiträge

Base-Auswahl, Fine-Tunes, Harnesses und Serving — private GPU, wenn Corpora nicht raus dürfen.

Base-Model-Auswahl 2026

Modell-Notizen aus Research-to-Prod-Programmen.

Datenqualitäts-Bars für Fine-Tunes

Modell-Notizen aus Research-to-Prod-Programmen.

Eval-Harness-Design

Modell-Notizen aus Research-to-Prod-Programmen.

Regression Gates, die schlechte Merges blocken

Modell-Notizen aus Research-to-Prod-Programmen.

Serving-Cost-Kurven

Modell-Notizen aus Research-to-Prod-Programmen.

LoRA vs Full Fine-Tunes

Modell-Notizen aus Research-to-Prod-Programmen.

Umgang mit privaten Corpora

Modell-Notizen aus Research-to-Prod-Programmen.

Tokenizer-Gotchas

Modell-Notizen aus Research-to-Prod-Programmen.

RLHF-lite für Product Teams

Modell-Notizen aus Research-to-Prod-Programmen.

Distillation-Playbook

Modell-Notizen aus Research-to-Prod-Programmen.

Multi-Model-Routing

Modell-Notizen aus Research-to-Prod-Programmen.

Latenz-SLOs für Modelle

Modell-Notizen aus Research-to-Prod-Programmen.

Observability für Model Serving

Modell-Notizen aus Research-to-Prod-Programmen.

Canary Deploys für Weights

Modell-Notizen aus Research-to-Prod-Programmen.

Prompt- vs Weight-Änderungen

Modell-Notizen aus Research-to-Prod-Programmen.

Safety Filter, die Product besitzt

Modell-Notizen aus Research-to-Prod-Programmen.

Domain Adapters

Modell-Notizen aus Research-to-Prod-Programmen.

Risiken von Continual Learning

Modell-Notizen aus Research-to-Prod-Programmen.

Model Cards, die Operatoren helfen

Modell-Notizen aus Research-to-Prod-Programmen.

Kill Switches im Serving

Modell-Notizen aus Research-to-Prod-Programmen.