Blog

Wszystkie wpisy

Wybór bazy, fine-tune'y, harnessy i serving — prywatne GPU, gdy corpus nie może wyjść.

Wybór modelu bazowego w 2026

Notatki modeli z programów research-to-prod.

Poprzeczki jakości danych fine-tune

Notatki modeli z programów research-to-prod.

Projekt harnessu eval

Notatki modeli z programów research-to-prod.

Bramki regresji blokujące złe merge

Notatki modeli z programów research-to-prod.

Krzywe kosztów serving

Notatki modeli z programów research-to-prod.

LoRA vs pełne fine-tune'y

Notatki modeli z programów research-to-prod.

Obsługa prywatnych corpora

Notatki modeli z programów research-to-prod.

Pułapki tokenizerów

Notatki modeli z programów research-to-prod.

RLHF-lite dla zespołów produktowych

Notatki modeli z programów research-to-prod.

Playbook destylacji

Notatki modeli z programów research-to-prod.

Routing multi-model

Notatki modeli z programów research-to-prod.

SLO latencji dla modeli

Notatki modeli z programów research-to-prod.

Obserwowalność servingu modeli

Notatki modeli z programów research-to-prod.

Deploy canary dla weights

Notatki modeli z programów research-to-prod.

Zmiany promptu vs weights

Notatki modeli z programów research-to-prod.

Filtry safety, które posiada produkt

Notatki modeli z programów research-to-prod.

Adaptery domenowe

Notatki modeli z programów research-to-prod.

Ryzyka continual learning

Notatki modeli z programów research-to-prod.

Model cards pomagające operatorom

Notatki modeli z programów research-to-prod.

Kill switche w servingu

Notatki modeli z programów research-to-prod.