ASM_PNS_C/Pytania do koncepcji.md
2026-06-25 15:49:45 +02:00

232 lines
13 KiB
Markdown
Raw Permalink Blame History

This file contains invisible Unicode characters

This file contains invisible Unicode characters that are indistinguishable to humans but may be processed differently by a computer. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# Pytania do koncepcji AdReactions (v0.2)
> Lista kwestii wymagających decyzji właściciela produktu. Pytania wynikają z analizy
> dokumentów źródłowych projektu i ich wzajemnych **rozbieżności oraz luk**. Każde pytanie
> ma kontekst, proponowaną odpowiedź roboczą (do akceptacji/zmiany) i odwołanie do sekcji
> w `Koncepcja 0.2 - rozszerzona.md`.
>
> Pogrupowano wg priorytetu wpływu na zakres MVP.
---
## 🔴 Priorytet 1 — przesądzają o zakresie i wiarygodności MVP
### Q1. Facial Coding w MVP — jest czy nie ma?
**Kontekst:** Katalog celów i kreator zakładają analizę **FC / ET+FC** (walencja, pobudzenie,
frustracja, ambiwalencja, komfort…). Tymczasem specyfikacja procesu AI obejmuje obecnie
wyłącznie detekcję obiektów i predykcję uwagi (saliency); **mapa emocji jest pozycją roadmapy
(§11 specyfikacji)** — nie ma jeszcze modelu Facial Coding.
**Pytanie:** Czy MVP 1.0 ma realnie liczyć metryki Facial Coding? Jeśli tak — jaki model/usługa
je dostarczy i kiedy będzie dostępny? Jeśli nie — czy ukrywamy opcje FC/ET+FC, czy pokazujemy je
jako „wkrótce"?
**Odp.:** Zostanie to dodane. Uruchomienie ma nastąpić w wersji MVP 1.0
### Q2. Wymiar czasu — „czas obserwacji 120s", mapy dynamiczne, scanpath
**Kontekst:** Obecne modele zwracają **jedną, statyczną** mapę uwagi. Raport zakłada
„wizualizacje statyczne 1/3/5/10/15/20s", „mapy dynamiczne 120s" i „ścieżki fiksacji" —
wszystko to wymaga **saliency czasowej / scanpath**, które są w roadmapie.
**Pytanie:** Czy parametr „czas obserwacji" i wizualizacje czasowe są w zakresie MVP? Jeśli nie —
czy pokazujemy pojedynczą mapę zagregowaną i ukrywamy oś czasu?
**Odp:** Zostanie to dodane do modeli. Uruchomienie ma nastąpić w wersji MVP 1.0
### Q3. Predykcje per grupa docelowa — jak technicznie?
**Kontekst:** Kreator zbiera bogaty profil grupy (wiek, płeć, miejsce, wykształcenie, dochód,
neuroatypowość, presety). `Opis celów…` zakłada, że ASM PNS generuje **różne predykcje dla
różnych segmentów**. Ale pipeline **nie przyjmuje demografii na wejściu** — żaden endpoint nie
ma takiego parametru.
**Pytanie:** Jak grupa docelowa ma wpływać na wynik? Opcje: (a) przez `prompt` modelu ASM,
(b) osobne wagi/warianty modelu per segment, (c) w MVP grupa jest tylko **metadanymi raportu**
bez wpływu na predykcję.
**Odp:** Mogą następić zmiany, które spowodują, że dane profilowe będą brane pod uwagę.
Przykładowo model zewnętrzny działający na Gemini może korzystać z danych profilowych a wewnętrzne nie.
### Q4. „Analiza kognitywna" (rekomendacja z uzasadnieniem) — kto/co ją generuje?
**Kontekst:** Rdzeń wartości produktu to zdanie typu „Wariant B wygrywa, ponieważ…". To **nowy
komponent** (warstwa interpretacji LLM nad metrykami) — nie istnieje w pipeline.
**Pytanie:** Czy budujemy tę warstwę w MVP? Jaki model ją realizuje (ASM? publiczny LLM?), na
jakich danych wejściowych (metryki + cel + grupa), z jakimi zabezpieczeniami przed „halucynacją"
rekomendacji?
**Odp:** Wyniki z poszczególnych modeli mają określone wyniki. Model (prywatny lub publiczny) będzie mógł przeanalizować wyniki i na podstawie celu klienta wybrać jaka kreacja będzie lepsza.
### Q5. Zakres celów w MVP
**Kontekst:** 15 celów; większość rekomenduje **ET+FC**. Bez FC i wymiaru czasu część celów
nie jest w pełni wykonalna (§9.5).
**Pytanie:** Które z 15 celów udostępniamy w MVP 1.0?
**Odp:** FC należy zrealizwać jako model publiczny nawet jeśli nie będzie dostępny jako model prywatny.
---
## 🟠 Priorytet 2 — architektura i wymienialność modeli
### Q6. Warstwa metryk — potwierdzenie zakresu i miejsca liczenia
**Kontekst:** Metryki „udziału uwagi na AOI" powstają z **przecięcia map saliency z obszarami
AOI** — to komponent backendu, a nie wynik zwracany przez modele (modele dostarczają mapy uwagi).
**Pytanie:** Potwierdzamy, że backend liczy metryki z map saliency (saliency ∩ AOI), a modele
dostarczają wyłącznie mapy? Jaka jest dokładna lista wskaźników w MVP?
**Nie rozumiem. Wyjaśnij dokładniej**
### Q7. Zakres wymienialności modeli (info.md)
**Kontekst:** Wymóg: zmiana modelu na inny (Gemini, Opus). Modele saliency/FC są jednak
wyspecjalizowane — publiczny LLM nie zastąpi ich 1:1.
**Pytanie:** Które procesy mają być wymienialne w MVP? Tylko „rozumienie treści” (etykiety/opis:
LLaVA↔Gemini/Opus), czy też predykcja uwagi (co wymaga modeli saliency innego dostawcy)?
**Odp:** W każdym zakresie można wymienić model. Przy wymianie modelu trzeba również wymianić kod jaki relizuje dany krok, tak aby wymiana zachowała spójność poszczególnych kroków procesu. Możliwe, że sam kod dla modeli publicznych powinien być jako plugin w oprogramowaniu.
Przykładowo:
- Nasz mode prywatny dostępny przez API (bez pluginu)
- Model publiczny Gemini (plugin dla wskazania obiektów dla modeli publicznych)
- Model publiczny Opus (plugin dla wskazania obiektów dla modeli publicznych)
### Q8. Konfiguracja modeli — gdzie i jak zarządzana?
**Kontekst:** Konfiguracja modeli (hosty, token/klucz, parametry) nie powinna być zaszyta w
kodzie ani w konfiguracji testowej — w MVP zarządzana z panelu administracyjnego.
**Pytanie:** Czy akceptujemy model „Proces ↔ Model" z adapterami, konfiguracją sekretów w panelu,
testem połączenia i wersjonowaniem przypisania (dla audytu, który model policzył raport)?
**Nie rozumiem. Wyjaśnij dokładniej**
### Q9. Obiekty vs AOI — skąd biorą się AOI semantyczne?
**Kontekst:** Pipeline wykrywa **obiekty** (LLaVA+DINO). AOI to **obszary marketingowe**
(CTA, Logo…). To inna kategoria niż „osoba/butelka".
**Pytanie:** AOI w MVP są: (a) wyłącznie ręczne (Studio), (b) AI sugeruje AOI osobnym modelem,
(c) mapowane heurystycznie z wykrytych obiektów?
**Odp:** MVP - automatycznie i ręcznie. Użytkownik na początku otrzymuje w Studio automatycznie wskzane AOI. Może je ręcznie zmienić AOI, wprowadzić nowe AOI.
---
## 🟡 Priorytet 3 — spójność dokumentów i reguły produktowe
### Q10. Typy testu: A/AB/ABC czy A/AB/AC/BC/ABC?
**Kontekst:** Koncepcja 0.1 raz podaje **A/AB/ABC** (Krok 2), a w use case 2 i `Opis celów…`
pojawia się **A/AB/AC/BC/ABC**.
**Pytanie:** Który zestaw obowiązuje? Czy potrzebne są wszystkie pary (AC, BC), czy slot A/B/C
jest stały?
**Odp:** Testy A, AB, A/AB/ABC
### Q11. Próg wieku „Seniorzy"
**Kontekst:** W jednym miejscu „Seniorzy (66 i więcej)”, opis grup mówi „Dorośli 2664” →
luka 65 lat.
**Odp:** Seniorzy (65 i więcej)
### Q12. Limit „jednej nowej organizacji" na użytkownika
**Kontekst:** „może dodać tylko jedną nową organizację”.
**Pytanie:** Czy to limit **zakładanych** organizacji (1 własna), czy łącznej **przynależności**?
Czy użytkownik może należeć do wielu organizacji przez zaproszenia?
**Odp:** Użytkownik zakłada max 1 organizację, ale może być członkiem wielu przez
zaproszenia.
### Q13. Rola „Gość" — zakres
**Kontekst:** Gość wymieniony w strukturze, bez zdefiniowanych uprawnień.
**Pytanie:** Co może gość? Propozycja: tylko podgląd udostępnionych raportów, bez tworzenia treści
i bez dostępu do rozliczeń.
**Odp:** Rezygnujemy z gościa. Będzie to użytkownik.
### Q14. Role projektowe — ujednolicenie
**Kontekst:** Koncepcja wymienia różne warianty („Editor/Viewer” oraz „usuwanie/edycja/
zapraszanie / edycja/zapraszanie / przeglądanie”).
**Pytanie:** Ile ról projektowych i jakie dokładnie uprawnienia? Propozycja: **Editor** /
**Viewer** (+ ewentualnie **Manager** z prawem usuwania i zarządzania dostępem). *(§5.2)*
**Odp:** Rezygunjemy z Editor/Viewer, zostawiamy tylko te ustalenia:
- Organizacja:
- Posiada Administratora
- Posiada Użytkowników
- Posiada Gości
- Posiada Projekty
- Role
- Super administrator - posiada dostęp do panelu administracyjnego, w którym może zarządzać organizacjami, użytkownikami, modelami AI. Super administrator może przejść do każdej z organizacji w systemie. Jeśli Super administrator wchodzi do organizacji to może w niej poruszać się tak jak Administrator.
- Administrator - Administrator organizacji powstaje podczas rejestracji Organizacji. Prawa administratora mogą zostać przekazane do innego użytkownika przez administratora.
- Użytkownik - Każdy użytkownik w platformie posiada własne niezależne konto.
- Uprawnienia
- Administrator - Posiada uprawnienia do każdego projektu, rozliczeń, planów i ustawień. Może tworzyć nowe projekty i eksperymenty bez ograniczeń.
- Użytkownik - może posiadać uprawnienia:
- Tworzenia nowych projektów
- Przeglądania wszystkich projektów
- Edytowania wszystkich projektów
- Usuwania wszystkich projektów
- Zapraszanie użytkowników do wszystkich projektów
- Użytkownik może również otrzymać uprawnienia w ramach projektu takie jak:
- Usuwanie, edycja i zapraszanie użytkowników
- Edycja i zapraszanie użytkowników
- Przeglądanie
---
## 🟢 Priorytet 4 — rozliczenia, eksport, prawne, i18n
### Q15. Model rozliczeń (kredyty/coiny)
**Pytanie:** Cennik eksperymentu (zależny od ET/FC/ET+FC i liczby kreacji?), zasady kredytów
miesięcznych vs globalnych, wygasanie, zachowanie przy przekroczeniu limitu, fakturowanie.
Brak danych w źródłach. *(§13)*
**Odp:** Super administrator w panelu może zdefiniować plany. Plan może zawiera takie dane jak:
- Nazwa
- Opis
- Liczbę kredytów na start
- Liczbę kredytów miesięcznie
- Miejsce na dysku
Plan jest dla całej organizacji.
Kredyty są pobierane za poszczególne eksprymenty. Przykładowo:
- Eskeryment A dla krecji graicznej - 5 kredytów
- Eskeryment AB dla krecji graicznej - 10 kredytów
- Eskeryment ABC dla krecji graicznej - 15 kredytów
### Q16. Plany subskrypcji i przestrzeń dyskowa
**Pytanie:** Jakie plany (nazwy, limity, ceny)? Cennik rozszerzenia dysku w kredytach? *(§13)*
**Odp:** jw.
### Q17. Eksport XLS / AVI
**Kontekst:** Use case 2 wymaga XLS (tabele metryk) i AVI (dynamiczne mapy/ścieżki).
**Pytanie:** Czy w MVP? AVI zależy od wizualizacji czasowych (Q2). Propozycja: PDF w MVP;
XLS gdy są metryki tabelaryczne; AVI z roadmapą czasową. *(§11.3)*
**Odp:** Ignorujemy eksport XLS / AVI
### Q18. Udostępnianie raportu linkiem — publiczne czy z logowaniem?
**Pytanie:** „Link do eksperymentu” to dostęp publiczny (każdy z linkiem), czy wymaga konta i
nadanej roli (Editor/Viewer)? Implikacje dla bezpieczeństwa treści klienta. *(§11.3, §15)*
**Odp:** Można utworzyć link publiczny. Bez wymogu logowania.
### Q19. Dane wysyłane do modeli publicznych (Gemini/Opus)
**Kontekst:** Podmiana na publiczny model = kreacje opuszczają infrastrukturę własną.
**Pytanie:** Czy wymagana zgoda klienta / oznaczenie w organizacji, że dany proces korzysta z
modelu zewnętrznego? *(§10.4, §15)*
**Odp:** Nie, klient nie decyduje na jakim modelu pracuje. To Super administrator decyduje jakie model i plugin jest stosowany dla danego procesu.
### Q20. Kategoria „neuroatypowość” — komunikacja i zgodność
**Pytanie:** Jak prezentować wyniki dla profili ASD/ADHD/depresja, by nie sugerować diagnozy?
Czy model w ogóle różnicuje predykcje wg neuroatypowości (powiązane z Q3)? *(§7.1, §15)*
**Odp:** Nie robimy takiego rozróżnienia
### Q21. Język raportu i interpretacji
**Pytanie:** Czy tekst rekomendacji (warstwa kognitywna) podąża za locale użytkownika (PL/EN)?
Czy prompt ASM zależy od języka, czy pozostaje stały (obecnie EN)? *(§16)*
**Odp:** Tak, jest dopasowana do języka w jaki wybrał użytkownik
---
## Pytania uzupełniające (do potwierdzenia kontraktów)
### Q22. Kontrakty odpowiedzi usług AI
W `Specyfikacja-procesu-AI.md` kształty odpowiedzi oznaczono „(wnioskowane)”. **Pytanie:** Czy
istnieje dokumentacja/realne odpowiedzi usług (LLaVA, DINO, DeepGaze, UNISAL, ASM) do
potwierdzenia pól (`labels`, `objects_bboxes`, `heatmap_b64`, `data`, `image_detailed/general`)?
**Odp:** Zostanie dostarczona
### Q23. Model ASM PNS — faktyczny zakres
**Kontekst:** ASM zwraca **2 mapy uwagi** (detailed/general), ale `Opis celów…` przypisuje mu też
predykcję **pobudzenia emocjonalnego / zapamiętywalności**. **Pytanie:** Co dokładnie ASM PNS
potrafi dziś, a co jest planem? Czy „detailed/general” odpowiadają jakimś pojęciom produktowym?
**Odp:** Zostanie dostrczony osobna dokumentacja modelu i ich możliwości
### Q24. Hosting i dostępność modeli
**Kontekst:** UNISAL i ASM współdzielą jeden host (`1.208.108.242:58951`).
**Pytanie:** Jaka jest docelowa infrastruktura produkcyjna (SLA, skalowanie, lokalizacja danych)?
**Odp:** jw
### Q25. „Ścieżka AOI” w MVP — przybliżenie czy nic?
**Pytanie:** Czy akceptujemy przybliżenie „ścieżki AOI” rankingiem AOI wg intensywności saliency
(z adnotacją, że to nie jest prawdziwy scanpath), czy komponent czeka na model scanpath? *(§9.5)*
**Wyjaśnij dokładniej**
---
*Po decyzjach: zaktualizować odpowiednie sekcje `Koncepcja 0.2 - rozszerzona.md` i usunąć
znaczniki [?].*