ASM_PNS_C/Pytania do koncepcji.md
2026-06-25 15:49:45 +02:00

13 KiB
Raw Blame History

Pytania do koncepcji AdReactions (v0.2)

Lista kwestii wymagających decyzji właściciela produktu. Pytania wynikają z analizy dokumentów źródłowych projektu i ich wzajemnych rozbieżności oraz luk. Każde pytanie ma kontekst, proponowaną odpowiedź roboczą (do akceptacji/zmiany) i odwołanie do sekcji w Koncepcja 0.2 - rozszerzona.md.

Pogrupowano wg priorytetu wpływu na zakres MVP.


🔴 Priorytet 1 — przesądzają o zakresie i wiarygodności MVP

Q1. Facial Coding w MVP — jest czy nie ma?

Kontekst: Katalog celów i kreator zakładają analizę FC / ET+FC (walencja, pobudzenie, frustracja, ambiwalencja, komfort…). Tymczasem specyfikacja procesu AI obejmuje obecnie wyłącznie detekcję obiektów i predykcję uwagi (saliency); mapa emocji jest pozycją roadmapy (§11 specyfikacji) — nie ma jeszcze modelu Facial Coding. Pytanie: Czy MVP 1.0 ma realnie liczyć metryki Facial Coding? Jeśli tak — jaki model/usługa je dostarczy i kiedy będzie dostępny? Jeśli nie — czy ukrywamy opcje FC/ET+FC, czy pokazujemy je jako „wkrótce"? Odp.: Zostanie to dodane. Uruchomienie ma nastąpić w wersji MVP 1.0

Q2. Wymiar czasu — „czas obserwacji 120s", mapy dynamiczne, scanpath

Kontekst: Obecne modele zwracają jedną, statyczną mapę uwagi. Raport zakłada „wizualizacje statyczne 1/3/5/10/15/20s", „mapy dynamiczne 120s" i „ścieżki fiksacji" — wszystko to wymaga saliency czasowej / scanpath, które są w roadmapie. Pytanie: Czy parametr „czas obserwacji" i wizualizacje czasowe są w zakresie MVP? Jeśli nie — czy pokazujemy pojedynczą mapę zagregowaną i ukrywamy oś czasu? Odp: Zostanie to dodane do modeli. Uruchomienie ma nastąpić w wersji MVP 1.0

Q3. Predykcje per grupa docelowa — jak technicznie?

Kontekst: Kreator zbiera bogaty profil grupy (wiek, płeć, miejsce, wykształcenie, dochód, neuroatypowość, presety). Opis celów… zakłada, że ASM PNS generuje różne predykcje dla różnych segmentów. Ale pipeline nie przyjmuje demografii na wejściu — żaden endpoint nie ma takiego parametru. Pytanie: Jak grupa docelowa ma wpływać na wynik? Opcje: (a) przez prompt modelu ASM, (b) osobne wagi/warianty modelu per segment, (c) w MVP grupa jest tylko metadanymi raportu bez wpływu na predykcję. Odp: Mogą następić zmiany, które spowodują, że dane profilowe będą brane pod uwagę. Przykładowo model zewnętrzny działający na Gemini może korzystać z danych profilowych a wewnętrzne nie.

Q4. „Analiza kognitywna" (rekomendacja z uzasadnieniem) — kto/co ją generuje?

Kontekst: Rdzeń wartości produktu to zdanie typu „Wariant B wygrywa, ponieważ…". To nowy komponent (warstwa interpretacji LLM nad metrykami) — nie istnieje w pipeline. Pytanie: Czy budujemy tę warstwę w MVP? Jaki model ją realizuje (ASM? publiczny LLM?), na jakich danych wejściowych (metryki + cel + grupa), z jakimi zabezpieczeniami przed „halucynacją" rekomendacji? Odp: Wyniki z poszczególnych modeli mają określone wyniki. Model (prywatny lub publiczny) będzie mógł przeanalizować wyniki i na podstawie celu klienta wybrać jaka kreacja będzie lepsza.

Q5. Zakres celów w MVP

Kontekst: 15 celów; większość rekomenduje ET+FC. Bez FC i wymiaru czasu część celów nie jest w pełni wykonalna (§9.5). Pytanie: Które z 15 celów udostępniamy w MVP 1.0? Odp: FC należy zrealizwać jako model publiczny nawet jeśli nie będzie dostępny jako model prywatny.


🟠 Priorytet 2 — architektura i wymienialność modeli

Q6. Warstwa metryk — potwierdzenie zakresu i miejsca liczenia

Kontekst: Metryki „udziału uwagi na AOI" powstają z przecięcia map saliency z obszarami AOI — to komponent backendu, a nie wynik zwracany przez modele (modele dostarczają mapy uwagi). Pytanie: Potwierdzamy, że backend liczy metryki z map saliency (saliency ∩ AOI), a modele dostarczają wyłącznie mapy? Jaka jest dokładna lista wskaźników w MVP? Nie rozumiem. Wyjaśnij dokładniej

Q7. Zakres wymienialności modeli (info.md)

Kontekst: Wymóg: zmiana modelu na inny (Gemini, Opus). Modele saliency/FC są jednak wyspecjalizowane — publiczny LLM nie zastąpi ich 1:1. Pytanie: Które procesy mają być wymienialne w MVP? Tylko „rozumienie treści” (etykiety/opis: LLaVA↔Gemini/Opus), czy też predykcja uwagi (co wymaga modeli saliency innego dostawcy)? Odp: W każdym zakresie można wymienić model. Przy wymianie modelu trzeba również wymianić kod jaki relizuje dany krok, tak aby wymiana zachowała spójność poszczególnych kroków procesu. Możliwe, że sam kod dla modeli publicznych powinien być jako plugin w oprogramowaniu. Przykładowo:

  • Nasz mode prywatny dostępny przez API (bez pluginu)
  • Model publiczny Gemini (plugin dla wskazania obiektów dla modeli publicznych)
  • Model publiczny Opus (plugin dla wskazania obiektów dla modeli publicznych)

Q8. Konfiguracja modeli — gdzie i jak zarządzana?

Kontekst: Konfiguracja modeli (hosty, token/klucz, parametry) nie powinna być zaszyta w kodzie ani w konfiguracji testowej — w MVP zarządzana z panelu administracyjnego. Pytanie: Czy akceptujemy model „Proces ↔ Model" z adapterami, konfiguracją sekretów w panelu, testem połączenia i wersjonowaniem przypisania (dla audytu, który model policzył raport)? Nie rozumiem. Wyjaśnij dokładniej

Q9. Obiekty vs AOI — skąd biorą się AOI semantyczne?

Kontekst: Pipeline wykrywa obiekty (LLaVA+DINO). AOI to obszary marketingowe (CTA, Logo…). To inna kategoria niż „osoba/butelka". Pytanie: AOI w MVP są: (a) wyłącznie ręczne (Studio), (b) AI sugeruje AOI osobnym modelem, (c) mapowane heurystycznie z wykrytych obiektów? Odp: MVP - automatycznie i ręcznie. Użytkownik na początku otrzymuje w Studio automatycznie wskzane AOI. Może je ręcznie zmienić AOI, wprowadzić nowe AOI.


🟡 Priorytet 3 — spójność dokumentów i reguły produktowe

Q10. Typy testu: A/AB/ABC czy A/AB/AC/BC/ABC?

Kontekst: Koncepcja 0.1 raz podaje A/AB/ABC (Krok 2), a w use case 2 i Opis celów… pojawia się A/AB/AC/BC/ABC. Pytanie: Który zestaw obowiązuje? Czy potrzebne są wszystkie pary (AC, BC), czy slot A/B/C jest stały? Odp: Testy A, AB, A/AB/ABC

Q11. Próg wieku „Seniorzy"

Kontekst: W jednym miejscu „Seniorzy (66 i więcej)”, opis grup mówi „Dorośli 2664” → luka 65 lat. Odp: Seniorzy (65 i więcej)

Q12. Limit „jednej nowej organizacji" na użytkownika

Kontekst: „może dodać tylko jedną nową organizację”. Pytanie: Czy to limit zakładanych organizacji (1 własna), czy łącznej przynależności? Czy użytkownik może należeć do wielu organizacji przez zaproszenia? Odp: Użytkownik zakłada max 1 organizację, ale może być członkiem wielu przez zaproszenia.

Q13. Rola „Gość" — zakres

Kontekst: Gość wymieniony w strukturze, bez zdefiniowanych uprawnień. Pytanie: Co może gość? Propozycja: tylko podgląd udostępnionych raportów, bez tworzenia treści i bez dostępu do rozliczeń. Odp: Rezygnujemy z gościa. Będzie to użytkownik.

Q14. Role projektowe — ujednolicenie

Kontekst: Koncepcja wymienia różne warianty („Editor/Viewer” oraz „usuwanie/edycja/ zapraszanie / edycja/zapraszanie / przeglądanie”). Pytanie: Ile ról projektowych i jakie dokładnie uprawnienia? Propozycja: Editor / Viewer (+ ewentualnie Manager z prawem usuwania i zarządzania dostępem). (§5.2) Odp: Rezygunjemy z Editor/Viewer, zostawiamy tylko te ustalenia:

  • Organizacja:
    • Posiada Administratora
    • Posiada Użytkowników
    • Posiada Gości
    • Posiada Projekty
  • Role
    • Super administrator - posiada dostęp do panelu administracyjnego, w którym może zarządzać organizacjami, użytkownikami, modelami AI. Super administrator może przejść do każdej z organizacji w systemie. Jeśli Super administrator wchodzi do organizacji to może w niej poruszać się tak jak Administrator.
    • Administrator - Administrator organizacji powstaje podczas rejestracji Organizacji. Prawa administratora mogą zostać przekazane do innego użytkownika przez administratora.
    • Użytkownik - Każdy użytkownik w platformie posiada własne niezależne konto.
  • Uprawnienia
    • Administrator - Posiada uprawnienia do każdego projektu, rozliczeń, planów i ustawień. Może tworzyć nowe projekty i eksperymenty bez ograniczeń.
    • Użytkownik - może posiadać uprawnienia:
      • Tworzenia nowych projektów
      • Przeglądania wszystkich projektów
      • Edytowania wszystkich projektów
      • Usuwania wszystkich projektów
      • Zapraszanie użytkowników do wszystkich projektów
      • Użytkownik może również otrzymać uprawnienia w ramach projektu takie jak:
        • Usuwanie, edycja i zapraszanie użytkowników
        • Edycja i zapraszanie użytkowników
        • Przeglądanie

🟢 Priorytet 4 — rozliczenia, eksport, prawne, i18n

Q15. Model rozliczeń (kredyty/coiny)

Pytanie: Cennik eksperymentu (zależny od ET/FC/ET+FC i liczby kreacji?), zasady kredytów miesięcznych vs globalnych, wygasanie, zachowanie przy przekroczeniu limitu, fakturowanie. Brak danych w źródłach. (§13) Odp: Super administrator w panelu może zdefiniować plany. Plan może zawiera takie dane jak:

  • Nazwa
  • Opis
  • Liczbę kredytów na start
  • Liczbę kredytów miesięcznie
  • Miejsce na dysku

Plan jest dla całej organizacji.

Kredyty są pobierane za poszczególne eksprymenty. Przykładowo:

  • Eskeryment A dla krecji graicznej - 5 kredytów
  • Eskeryment AB dla krecji graicznej - 10 kredytów
  • Eskeryment ABC dla krecji graicznej - 15 kredytów

Q16. Plany subskrypcji i przestrzeń dyskowa

Pytanie: Jakie plany (nazwy, limity, ceny)? Cennik rozszerzenia dysku w kredytach? (§13) Odp: jw.

Q17. Eksport XLS / AVI

Kontekst: Use case 2 wymaga XLS (tabele metryk) i AVI (dynamiczne mapy/ścieżki). Pytanie: Czy w MVP? AVI zależy od wizualizacji czasowych (Q2). Propozycja: PDF w MVP; XLS gdy są metryki tabelaryczne; AVI z roadmapą czasową. (§11.3) Odp: Ignorujemy eksport XLS / AVI

Q18. Udostępnianie raportu linkiem — publiczne czy z logowaniem?

Pytanie: „Link do eksperymentu” to dostęp publiczny (każdy z linkiem), czy wymaga konta i nadanej roli (Editor/Viewer)? Implikacje dla bezpieczeństwa treści klienta. (§11.3, §15) Odp: Można utworzyć link publiczny. Bez wymogu logowania.

Q19. Dane wysyłane do modeli publicznych (Gemini/Opus)

Kontekst: Podmiana na publiczny model = kreacje opuszczają infrastrukturę własną. Pytanie: Czy wymagana zgoda klienta / oznaczenie w organizacji, że dany proces korzysta z modelu zewnętrznego? (§10.4, §15) Odp: Nie, klient nie decyduje na jakim modelu pracuje. To Super administrator decyduje jakie model i plugin jest stosowany dla danego procesu.

Q20. Kategoria „neuroatypowość” — komunikacja i zgodność

Pytanie: Jak prezentować wyniki dla profili ASD/ADHD/depresja, by nie sugerować diagnozy? Czy model w ogóle różnicuje predykcje wg neuroatypowości (powiązane z Q3)? (§7.1, §15) Odp: Nie robimy takiego rozróżnienia

Q21. Język raportu i interpretacji

Pytanie: Czy tekst rekomendacji (warstwa kognitywna) podąża za locale użytkownika (PL/EN)? Czy prompt ASM zależy od języka, czy pozostaje stały (obecnie EN)? (§16) Odp: Tak, jest dopasowana do języka w jaki wybrał użytkownik


Pytania uzupełniające (do potwierdzenia kontraktów)

Q22. Kontrakty odpowiedzi usług AI

W Specyfikacja-procesu-AI.md kształty odpowiedzi oznaczono „(wnioskowane)”. Pytanie: Czy istnieje dokumentacja/realne odpowiedzi usług (LLaVA, DINO, DeepGaze, UNISAL, ASM) do potwierdzenia pól (labels, objects_bboxes, heatmap_b64, data, image_detailed/general)? Odp: Zostanie dostarczona

Q23. Model ASM PNS — faktyczny zakres

Kontekst: ASM zwraca 2 mapy uwagi (detailed/general), ale Opis celów… przypisuje mu też predykcję pobudzenia emocjonalnego / zapamiętywalności. Pytanie: Co dokładnie ASM PNS potrafi dziś, a co jest planem? Czy „detailed/general” odpowiadają jakimś pojęciom produktowym? Odp: Zostanie dostrczony osobna dokumentacja modelu i ich możliwości

Q24. Hosting i dostępność modeli

Kontekst: UNISAL i ASM współdzielą jeden host (1.208.108.242:58951). Pytanie: Jaka jest docelowa infrastruktura produkcyjna (SLA, skalowanie, lokalizacja danych)? Odp: jw

Q25. „Ścieżka AOI” w MVP — przybliżenie czy nic?

Pytanie: Czy akceptujemy przybliżenie „ścieżki AOI” rankingiem AOI wg intensywności saliency (z adnotacją, że to nie jest prawdziwy scanpath), czy komponent czeka na model scanpath? (§9.5) Wyjaśnij dokładniej


Po decyzjach: zaktualizować odpowiednie sekcje Koncepcja 0.2 - rozszerzona.md i usunąć znaczniki [?].