02

Format współpracy

RAG i agentowe workflow oparte na własnych źródłach

Projekt RAG i workflow agentowego z granicami korpusu, wersjami źródeł, cytowaniami, ewaluacją i punktami decyzji człowieka przed ograniczonym pilotażem.

Opisz zadanie
01

Problem

Co trzeba rozstrzygnąć

Ogólny chat nie wystarcza, gdy wynik musi pochodzić z właściwego korpusu, zachować wersję, cytowania i granice odpowiedzialności między narzędziem a specjalistą.

02

Dopasowanie

Dla kogo

Dla profesjonalnego procesu, który potrzebuje własnych źródeł i kontrolowanego artefaktu zamiast ogólnego czatu.

03

Rezultat

Co pozostaje po pracy

  1. Specyfikacja architektury
  2. Model danych i provenance
  3. Scenariusze benchmarku
  4. Ograniczony workflow
04

Proces

Jak przebiega praca

  1. 01Job-to-be-done
  2. 02Źródła
  3. 03Role i narzędzia
  4. 04Ewaluacja
  5. 05Pilot
05

Zakres

Od wejścia do decyzji

Kiedy to jest potrzebne

Ten format jest dla zespołu, który nie chce kolejnego ogólnego czatu, lecz workflow oparte na własnym korpusie. Problemem jest zwykle nie wybór frameworka, lecz granica źródła, wersja materiału, cytowanie i moment, w którym człowiek musi podjąć decyzję.

Materiały wejściowe

Potrzebne są opis korpusu, dostęp i wersje źródeł, zadanie użytkownika, przykłady negatywnego retrievalu lub błędnego cytatu oraz właściciel przejęcia. To pozwala sprawdzić nie tylko odpowiedź, ale również to, czego system nie powinien zwrócić.

Co robimy

Projekt obejmuje kontrakt źródła, model provenance, retrieval, role narzędziowe, punkt zatrzymania i scenariusze ewaluacji. Agent nie jest domyślnym rozwiązaniem: dodatkową rolę uzasadnia się tylko wtedy, gdy wnosi odrębną odpowiedzialność lub kontrolę.

Artefakt i rezultat

Rezultatem jest architektura, model provenance, benchmark z przypadkami pozytywnymi i negatywnymi, ograniczony workflow oraz runbook przekazania. Artefakty opisują wersje, cytowanie, kontrole i sposób ponownego uruchomienia testu po zmianie.

Kryterium przyjęcia

Akceptacja wymaga, aby dla reprezentatywnego zadania można było wskazać granice korpusu, źródło i wersję wyniku, kryterium błędu, punkt review oraz zakres pilotażu.

Granica odpowiedzialności

Nie zaczynam od nazwy vendora ani frameworka i nie obiecuję autonomicznego agenta. System może wspierać przygotowanie materiału, ale nie zastępuje właściciela decyzji ani kontroli dostępu do źródeł.

Rejestr decyzji

Decyzja projektowa powinna wskazać, kiedy wystarcza retrieval albo prosty deterministyczny krok, a kiedy rola agentowa jest uzasadniona. Rekord obejmuje granice źródła, uprawnienia narzędzia, punkt zatrzymania i osobę zatwierdzającą użycie rezultatu. Dzięki temu złożoność nie jest mylona z postępem.

06

Granice

Ryzyka, które sprawdzamy wcześnie

  • Retrieval bez negatywnych przykładów
  • Brak wersjonowania
  • Niejasny human-in-the-loop
07

Ścieżka dowodowa

Istniejące materiały, które pokazują zakres pracy

08

FAQ

Praktyczne pytania

Czy zawsze potrzebny jest framework agentowy?

Nie. Prosty, jawny pipeline jest często łatwiejszy do testowania i zmiany.

Kiedy agent nie jest właściwym rozwiązaniem?

Jeżeli zadanie da się bezpiecznie opisać jako deterministyczny krok lub prosty retrieval z cytowaniem, dodatkowa autonomia może tylko poszerzyć powierzchnię błędu. Agent ma sens dopiero wtedy, gdy jego rola, narzędzia, uprawnienia i punkt zatrzymania są jawne.

Jak sprawdzane są źródła i cytowania?

Zespół ustala granice korpusu, wersję źródła, przypadki negatywnego retrievalu i regułę cytowania przed oceną odpowiedzi. Benchmark sprawdza nie tylko trafny wynik, lecz także brak podstawy, nieaktualny fragment i moment przekazania sprawy człowiekowi.

09

Zakres i koszt

Najpierw materiał, potem wycena

Nie publikuję fikcyjnej ceny „od”. Zakres i wycena powstają po sprawdzeniu procesu, dostępności materiału, ryzyka, oczekiwanego artefaktu i kryterium akceptacji.

Najpierw opisz proces

Pierwsza odpowiedź określi, czy ten format pasuje i czego potrzeba do uczciwego określenia zakresu.

Rozpocznij rozmowę