All posts
Base selection, fine-tunes, harnesses, and serving — private GPU when corpora cannot leave.
Base model selection in 2026
Model notes from research-to-prod programs.
Fine-tune data quality bars
Model notes from research-to-prod programs.
Eval harness design
Model notes from research-to-prod programs.
Regression gates that block bad merges
Model notes from research-to-prod programs.
Serving cost curves
Model notes from research-to-prod programs.
LoRA vs full fine-tunes
Model notes from research-to-prod programs.
Private corpora handling
Model notes from research-to-prod programs.
Tokenizer gotchas
Model notes from research-to-prod programs.
RLHF-lite for product teams
Model notes from research-to-prod programs.
Distillation playbook
Model notes from research-to-prod programs.
Multi-model routing
Model notes from research-to-prod programs.
Latency SLOs for models
Model notes from research-to-prod programs.
Observability for model serving
Model notes from research-to-prod programs.
Canary deploys for weights
Model notes from research-to-prod programs.
Prompt vs weight changes
Model notes from research-to-prod programs.
Safety filters that product owns
Model notes from research-to-prod programs.
Domain adapters
Model notes from research-to-prod programs.
Continual learning risks
Model notes from research-to-prod programs.
Model cards that help operators
Model notes from research-to-prod programs.
Kill switches in serving
Model notes from research-to-prod programs.