ASM_PNS_C/Pytania do koncepcji.md

189 lines
11 KiB
Markdown
Raw Normal View History

# Pytania do koncepcji AdReactions (v0.2)
> Lista kwestii wymagających decyzji właściciela produktu. Pytania wynikają z analizy
> dokumentów źródłowych projektu i ich wzajemnych **rozbieżności oraz luk**. Każde pytanie
> ma kontekst, proponowaną odpowiedź roboczą (do akceptacji/zmiany) i odwołanie do sekcji
> w `Koncepcja 0.2 - rozszerzona.md`.
>
> Pogrupowano wg priorytetu wpływu na zakres MVP.
---
## 🔴 Priorytet 1 — przesądzają o zakresie i wiarygodności MVP
### Q1. Facial Coding w MVP — jest czy nie ma?
**Kontekst:** Katalog celów i kreator zakładają analizę **FC / ET+FC** (walencja, pobudzenie,
frustracja, ambiwalencja, komfort…). Tymczasem specyfikacja procesu AI obejmuje obecnie
wyłącznie detekcję obiektów i predykcję uwagi (saliency); **mapa emocji jest pozycją roadmapy
(§11 specyfikacji)** — nie ma jeszcze modelu Facial Coding.
**Pytanie:** Czy MVP 1.0 ma realnie liczyć metryki Facial Coding? Jeśli tak — jaki model/usługa
je dostarczy i kiedy będzie dostępny? Jeśli nie — czy ukrywamy opcje FC/ET+FC, czy pokazujemy je
jako „wkrótce"?
**Propozycja robocza:** MVP dostarcza **ET (saliency statyczna)**; opcje FC oznaczone „wkrótce".
*(§9.4, §9.5, §18)*
### Q2. Wymiar czasu — „czas obserwacji 120s", mapy dynamiczne, scanpath
**Kontekst:** Obecne modele zwracają **jedną, statyczną** mapę uwagi. Raport zakłada
„wizualizacje statyczne 1/3/5/10/15/20s", „mapy dynamiczne 120s" i „ścieżki fiksacji" —
wszystko to wymaga **saliency czasowej / scanpath**, które są w roadmapie.
**Pytanie:** Czy parametr „czas obserwacji" i wizualizacje czasowe są w zakresie MVP? Jeśli nie —
czy pokazujemy pojedynczą mapę zagregowaną i ukrywamy oś czasu?
**Propozycja robocza:** MVP = jedna mapa statyczna; oś czasu w roadmapie. *(§7.2, §9.5, §11.1)*
### Q3. Predykcje per grupa docelowa — jak technicznie?
**Kontekst:** Kreator zbiera bogaty profil grupy (wiek, płeć, miejsce, wykształcenie, dochód,
neuroatypowość, presety). `Opis celów…` zakłada, że ASM PNS generuje **różne predykcje dla
różnych segmentów**. Ale pipeline **nie przyjmuje demografii na wejściu** — żaden endpoint nie
ma takiego parametru.
**Pytanie:** Jak grupa docelowa ma wpływać na wynik? Opcje: (a) przez `prompt` modelu ASM,
(b) osobne wagi/warianty modelu per segment, (c) w MVP grupa jest tylko **metadanymi raportu**
bez wpływu na predykcję.
**Propozycja robocza:** w MVP (c) — grupa opisuje kontekst i interpretację, nie zmienia mapy
uwagi; różnicowanie per segment → roadmapa. *(§7.1, §9.4, §9.5)*
### Q4. „Analiza kognitywna" (rekomendacja z uzasadnieniem) — kto/co ją generuje?
**Kontekst:** Rdzeń wartości produktu to zdanie typu „Wariant B wygrywa, ponieważ…". To **nowy
komponent** (warstwa interpretacji LLM nad metrykami) — nie istnieje w pipeline.
**Pytanie:** Czy budujemy tę warstwę w MVP? Jaki model ją realizuje (ASM? publiczny LLM?), na
jakich danych wejściowych (metryki + cel + grupa), z jakimi zabezpieczeniami przed „halucynacją"
rekomendacji?
**Propozycja robocza:** TAK, to priorytet MVP; realizacja przez LLM z **ustrukturyzowanym
wejściem** (policzone metryki), nie przez „opowieść" o obrazie. *(§9.4, §11.1, §18)*
### Q5. Zakres celów w MVP
**Kontekst:** 15 celów; większość rekomenduje **ET+FC**. Bez FC i wymiaru czasu część celów
nie jest w pełni wykonalna (§9.5).
**Pytanie:** Które z 15 celów udostępniamy w MVP 1.0?
**Propozycja robocza:** start od celów silnie ET (#2, #7, #1, #3), reszta „wkrótce". *(§8, §18)*
---
## 🟠 Priorytet 2 — architektura i wymienialność modeli
### Q6. Warstwa metryk — potwierdzenie zakresu i miejsca liczenia
**Kontekst:** Metryki „udziału uwagi na AOI" powstają z **przecięcia map saliency z obszarami
AOI** — to komponent backendu, a nie wynik zwracany przez modele (modele dostarczają mapy uwagi).
**Pytanie:** Potwierdzamy, że backend liczy metryki z map saliency (saliency ∩ AOI), a modele
dostarczają wyłącznie mapy? Jaka jest dokładna lista wskaźników w MVP?
**Propozycja robocza:** tak; MVP liczy udział uwagi na AOI, ranking AOI i porównanie wariantów
(zakres ET-static). *(§9.5, §11.1)*
### Q7. Zakres wymienialności modeli (info.md)
**Kontekst:** Wymóg: zmiana modelu na inny (Gemini, Opus). Modele saliency/FC są jednak
wyspecjalizowane — publiczny LLM nie zastąpi ich 1:1.
**Pytanie:** Które procesy mają być wymienialne w MVP? Tylko „rozumienie treści” (etykiety/opis:
LLaVA↔Gemini/Opus), czy też predykcja uwagi (co wymaga modeli saliency innego dostawcy)?
**Propozycja robocza:** wymienialność w MVP dla procesów językowo-wizualnych; predykcja uwagi
pozostaje na modelach własnych (ASM jako rdzeń). *(§10.1, §10.4)*
### Q8. Konfiguracja modeli — gdzie i jak zarządzana?
**Kontekst:** Konfiguracja modeli (hosty, token/klucz, parametry) nie powinna być zaszyta w
kodzie ani w konfiguracji testowej — w MVP zarządzana z panelu administracyjnego.
**Pytanie:** Czy akceptujemy model „Proces ↔ Model" z adapterami, konfiguracją sekretów w panelu,
testem połączenia i wersjonowaniem przypisania (dla audytu, który model policzył raport)?
**Propozycja robocza:** TAK (§10.210.3, encje `ai_processes` / `ai_models` /
`process_model_binding` w §12). *(§10, §12)*
### Q9. Obiekty vs AOI — skąd biorą się AOI semantyczne?
**Kontekst:** Pipeline wykrywa **obiekty** (LLaVA+DINO). AOI to **obszary marketingowe**
(CTA, Logo…). To inna kategoria niż „osoba/butelka".
**Pytanie:** AOI w MVP są: (a) wyłącznie ręczne (Studio), (b) AI sugeruje AOI osobnym modelem,
(c) mapowane heurystycznie z wykrytych obiektów?
**Propozycja robocza:** MVP — AOI ręczne + ewentualne podpowiedzi z obiektów; pełna „AI-detekcja
AOI” to osobny model. *(§7.3, §11.1)*
---
## 🟡 Priorytet 3 — spójność dokumentów i reguły produktowe
### Q10. Typy testu: A/AB/ABC czy A/AB/AC/BC/ABC?
**Kontekst:** Koncepcja 0.1 raz podaje **A/AB/ABC** (Krok 2), a w use case 2 i `Opis celów…`
pojawia się **A/AB/AC/BC/ABC**.
**Pytanie:** Który zestaw obowiązuje? Czy potrzebne są wszystkie pary (AC, BC), czy slot A/B/C
jest stały?
**Propozycja robocza:** pełny zestaw A/AB/AC/BC/ABC (większa elastyczność porównań). *(§7.2)*
### Q11. Próg wieku „Seniorzy"
**Kontekst:** W jednym miejscu „Seniorzy (66 i więcej)”, opis grup mówi „Dorośli 2664” →
luka 65 lat.
**Pytanie:** Ustalić progi bez luki (proponowane: Senior **65+**). *(§7.1)*
### Q12. Limit „jednej nowej organizacji" na użytkownika
**Kontekst:** „może dodać tylko jedną nową organizację”.
**Pytanie:** Czy to limit **zakładanych** organizacji (1 własna), czy łącznej **przynależności**?
Czy użytkownik może należeć do wielu organizacji przez zaproszenia?
**Propozycja robocza:** użytkownik zakłada max 1 organizację, ale może być członkiem wielu przez
zaproszenia. *(§3, §5, §6.2)*
### Q13. Rola „Gość" — zakres
**Kontekst:** Gość wymieniony w strukturze, bez zdefiniowanych uprawnień.
**Pytanie:** Co może gość? Propozycja: tylko podgląd udostępnionych raportów, bez tworzenia treści
i bez dostępu do rozliczeń. *(§5.1, §5.2)*
### Q14. Role projektowe — ujednolicenie
**Kontekst:** Koncepcja wymienia różne warianty („Editor/Viewer” oraz „usuwanie/edycja/
zapraszanie / edycja/zapraszanie / przeglądanie”).
**Pytanie:** Ile ról projektowych i jakie dokładnie uprawnienia? Propozycja: **Editor** /
**Viewer** (+ ewentualnie **Manager** z prawem usuwania i zarządzania dostępem). *(§5.2)*
---
## 🟢 Priorytet 4 — rozliczenia, eksport, prawne, i18n
### Q15. Model rozliczeń (kredyty/coiny)
**Pytanie:** Cennik eksperymentu (zależny od ET/FC/ET+FC i liczby kreacji?), zasady kredytów
miesięcznych vs globalnych, wygasanie, zachowanie przy przekroczeniu limitu, fakturowanie.
Brak danych w źródłach. *(§13)*
### Q16. Plany subskrypcji i przestrzeń dyskowa
**Pytanie:** Jakie plany (nazwy, limity, ceny)? Cennik rozszerzenia dysku w kredytach? *(§13)*
### Q17. Eksport XLS / AVI
**Kontekst:** Use case 2 wymaga XLS (tabele metryk) i AVI (dynamiczne mapy/ścieżki).
**Pytanie:** Czy w MVP? AVI zależy od wizualizacji czasowych (Q2). Propozycja: PDF w MVP;
XLS gdy są metryki tabelaryczne; AVI z roadmapą czasową. *(§11.3)*
### Q18. Udostępnianie raportu linkiem — publiczne czy z logowaniem?
**Pytanie:** „Link do eksperymentu” to dostęp publiczny (każdy z linkiem), czy wymaga konta i
nadanej roli (Editor/Viewer)? Implikacje dla bezpieczeństwa treści klienta. *(§11.3, §15)*
### Q19. Dane wysyłane do modeli publicznych (Gemini/Opus)
**Kontekst:** Podmiana na publiczny model = kreacje opuszczają infrastrukturę własną.
**Pytanie:** Czy wymagana zgoda klienta / oznaczenie w organizacji, że dany proces korzysta z
modelu zewnętrznego? *(§10.4, §15)*
### Q20. Kategoria „neuroatypowość” — komunikacja i zgodność
**Pytanie:** Jak prezentować wyniki dla profili ASD/ADHD/depresja, by nie sugerować diagnozy?
Czy model w ogóle różnicuje predykcje wg neuroatypowości (powiązane z Q3)? *(§7.1, §15)*
### Q21. Język raportu i interpretacji
**Pytanie:** Czy tekst rekomendacji (warstwa kognitywna) podąża za locale użytkownika (PL/EN)?
Czy prompt ASM zależy od języka, czy pozostaje stały (obecnie EN)? *(§16)*
---
## Pytania uzupełniające (do potwierdzenia kontraktów)
### Q22. Kontrakty odpowiedzi usług AI
W `Specyfikacja-procesu-AI.md` kształty odpowiedzi oznaczono „(wnioskowane)”. **Pytanie:** Czy
istnieje dokumentacja/realne odpowiedzi usług (LLaVA, DINO, DeepGaze, UNISAL, ASM) do
potwierdzenia pól (`labels`, `objects_bboxes`, `heatmap_b64`, `data`, `image_detailed/general`)?
### Q23. Model ASM PNS — faktyczny zakres
**Kontekst:** ASM zwraca **2 mapy uwagi** (detailed/general), ale `Opis celów…` przypisuje mu też
predykcję **pobudzenia emocjonalnego / zapamiętywalności**. **Pytanie:** Co dokładnie ASM PNS
potrafi dziś, a co jest planem? Czy „detailed/general” odpowiadają jakimś pojęciom produktowym?
### Q24. Hosting i dostępność modeli
**Kontekst:** UNISAL i ASM współdzielą jeden host (`1.208.108.242:58951`).
**Pytanie:** Jaka jest docelowa infrastruktura produkcyjna (SLA, skalowanie, lokalizacja danych)?
### Q25. „Ścieżka AOI” w MVP — przybliżenie czy nic?
**Pytanie:** Czy akceptujemy przybliżenie „ścieżki AOI” rankingiem AOI wg intensywności saliency
(z adnotacją, że to nie jest prawdziwy scanpath), czy komponent czeka na model scanpath? *(§9.5)*
---
*Po decyzjach: zaktualizować odpowiednie sekcje `Koncepcja 0.2 - rozszerzona.md` i usunąć
znaczniki [?].*