Realizacja - Baza 10 000+ przepisów po polsku, zbudowana pipeline'em AI
Baza ponad 10 000 przepisów po polsku, gotowych do publikacji - selekcja z danych w domenie publicznej, tłumaczenie z pełną redakcją, kategoryzacja, zdjęcia AI i automatyczna kontrola jakości.
- Klient
- LosSmaku
- Kraj
- 🇵🇱Polska
- Rok
- Usługa
- Pipeline treści AI
Wprowadzenie
LosSmaku to serwis kulinarny, który potrzebował dużej, wiarygodnej bazy przepisów po polsku - a ręczne pisanie tysięcy przepisów było poza budżetem i harmonogramem.
Warunki były twarde: wyłącznie dane z domeny publicznej, treści brzmiące redakcyjnie, nie jak tłumaczenie maszynowe, i dostawa w strukturze CSV dopasowanej do systemu programisty klienta.
Jak to działa
- Selekcja - z publicznego datasetu (CC0) pipeline wybiera tylko wartościowe przepisy: ranking popularności ważony ocenami, wyłącznie pozycje z autorskim opisem, automatyczne odrzucanie niekompletnych.
- Tłumaczenie z pełną redakcją - glosariusz spolszczonych składników, jednostki metryczne z kuchennym zaokrągleniem, usuwanie amerykańskich marek, tytuły generowane na nowo z treści przepisu zamiast tłumaczenia oryginału.
- Kategoryzacja, liczba porcji i zdjęcia AI w stylu i kolorach marki - wszystko przypisane do przepisów bezpośrednio w plikach.
- Automatyczne bramki jakości - zgodność kroków ze źródłem, wykrywanie angielskich wtrąceń, skan marek i jednostek imperialnych; co nie przeszło kontroli, wracało do poprawki, zanim klient to zobaczył.
- Podgląd na żywo - prosta aplikacja webowa, w której klient akceptował jakość, zanim dostał pliki: najpierw pilot i runda feedbacku, potem pełna baza.
Efekt: kompletna, spójna baza przepisów po polsku - z opisami, kategoriami, porcjami i zdjęciami - gotowa do wdrożenia w serwisie klienta.