FAQ
Otázky a odpovědi
Otázky, které dostávám nejčastěji, zodpovězené pořádně, ne stručně. Pokud ta vaše není tady, napište mi přímo.
Tohle jsou otázky, které na prvním hovoru padnou téměř při každé spolupráci.
Začátek
Co přesně děláte?
Tři věci, vrstvené. AI infrastruktura je platforma pod každou AI funkcí — směrování modelů, retrieval, evaluace, observabilita, kontrola nákladů. AI agenti jsou systémy, které ve vašich nástrojích provádějí akce s řádnými oprávněními a lidským dohledem. AI chatboty na webech jsou zákaznická verze, v angličtině, češtině a slovenštině, měřené tak, abyste dokázali doložit, jestli pomáhají.
Jak poznám, které potřebuji?
Podívejte se, kde uvázli. Pokud pilot funguje, ale nikdo ho neumí nasadit ani změřit, potřebujete infrastrukturu. Pokud model úkol nezvládne, protože se musí dotknout reálných systémů, potřebujete agenty. Pokud návštěvníci posílají pořád týchž osm otázek, potřebujete asistenta na web. Pokud si nejste jistí, přesně na to je audit.
Kolik stojí AI projekt?
Soustředěný asistent na web začíná kolem €4,900. Prototyp agenta v režimu stínu stojí €6,500–15,000. Práce na platformě a infrastruktuře běží za €850–1,100 denně. Průběžný provoz stojí €1,200–3,500 měsíčně. Kompletní rozsahy jsou na ceníku.
Jak dlouho to trvá?
Audit 1–2 týdny. Základ 2–4 týdny. První produkční funkce 3–8 týdnů podle rozsahu. Rychlost je hlavně funkcí toho, jak čistá jsou vaše data a kolik schválení release potřebuje, ne toho, jak rychle píšu.
Technologie
Které LLM máme používat?
To, které podává nejlepší výkon na vaší eval sadě za přijatelnou cenu — což obvykle nezjistíte dřív, než eval sadu postavíte. Moje výchozí volba: Anthropic pro složité uvažování, OpenAI tam, kde potřebujete nejširší ekosystém, a menší modely pro klasifikaci a směrování.
Potřebujeme vlastní GPU cluster?
Obvykle ne. Hostované API a dobře postavená gateway jsou pro téměř každý firemní případ levnější a rychlejší na start. Self-hosting se stává správnou odpovědí, když data nesmějí opustit síť, když máte stabilně vysoké objemy, nebo když konkrétní open model měřitelně poráží hostované modely na vaší zátěži.
RAG, nebo fine-tuning?
Retrieval pro vše, co se mění; fine-tuning pro chování, styl a formát. Fine-tuning nenaučí model vaše aktualizované pravidlo pro vracení peněz. Delší argumentace je v RAG vs fine-tuning.
Budou se naše data používat k trénování modelů?
U podmínek pro firmy od Anthropic, OpenAI a Google se vaše data ve výchozím nastavení k trénování nepoužívají. Jde o smluvní bod a postarám se, aby konkrétní tarif, který podepíšete, odpovídal konkrétním slibům, které potřebujete. Pokud potřebujete jistotu za hranicí smlouvy, odpovědí je self-hosted inference.
Můžete pracovat s naším stávajícím stackem?
Ano a je to i moje volba. Python, Java, .NET, cokoli — AI vrstva se přizpůsobí vašemu týmu, ne naopak. Nebudu přepisovat funkční infrastrukturu podle svých preferencí.
Data, soukromí a bezpečnost
Může AI vidět naše důvěrná data?
Musí, aby byla užitečná — ale to řídí návrh. Data zůstávají ve vaší infrastruktuře, putují šifrovaně, na hranici se maskují, kde je potřeba, a nezapisují se do logů třetích stran. Přístup k knowledge base se filtruje po uživatelích v okamžiku dotazu pomocí vaší vlastní autorizace.
Je chatbot v souladu s GDPR?
Může být, ale je potřeba záměrná práce: žádné third-party sledování, souhlas před ukládáním osobních údajů, krátká retence přepisů, nezaznamenávání IP adres, zpracovatelé uvedení ve vašich zásadách ochrany osobních údajů a jasná poznámka o tom, že asistent je automatizovaný systém. Řeknu vám také, které části nelze poctivě udělat v souladu s předpisy.
Jak bráníte prompt injection?
Tím, že obsahu ani promptům ve výchozím nastavení nevěřím. Nedůvěryhodný text je oddělen od instrukcí, každý nástroj nese vlastní minimální oprávnění, výstupy se validují a v CI běží adversarial testovací sada. Představa, že prompt je odolný proti injection, je chyba, které se bráním nejvíc.
Podepisujete NDAs a procházíte security review?
Ano. Vzájemné NDA dřív, než se dozvím jakýkoli detail systému, a bezpečnostní dotazníky, DPAs a smlouvy o zpracování dat jsou pro mě běžné. Kde jsou požadavky přísné, umím dodávat v plně on-premise prostředí.
Spolupráce
Pracujete na dálku?
Téměř vždy. Na dálku po celé EU je výchozí stav; osobně v Bratislavě nebo Vídni po domluvě. Se týmy v USA i Asii jsem pracoval tak, že jsem to postavil na písemných updatech a asynchronních rozhodnutích.
Pracujete s našimi interními vývojáři?
To je můj preferovaný model. Pracuji ve vašich repozitářích a vašem review procesu a po sobě nechávám dokumentaci a testy, ne černou skříňku. Několik mých spoluprací skončilo proto, že tým už mě nepotřeboval.
Co když to nefunguje?
Zjistíte to v auditu, za pevnou cenu, a plán si necháte. Ve fázích dodávky jsou akceptační kritéria sepsaná dřív, než se začne pracovat, takže „nefunguje to“ je definovaný rozhovor, ne dohad.
Na jakých jazycích pracujete?
Anglicky, česky a slovensky — pro komunikaci, dokumentaci i produkty. Každý vícejazyčný systém, který stavím, je pro všechny tři navržený od začátku, včetně oddělených eval sad pro každý jazyk.