ASM_PNS_C/Pytania do koncepcji.md
majkarol cd292e3198 Inicjalizacja repozytorium: koncepcja platformy AdReactions + specyfikacja AI
Zawartość:
- Koncepcja 0.1 oraz rozszerzona Koncepcja 0.2 (model domenowy, architektura,
  mapowanie cel→metryki→usługi AI, wymienialność modeli, model danych)
- Katalog 15 celów analiz kognitywnych
- Specyfikacja procesu AI + opis procesów źródłowych
- Pytania do koncepcji
- Materiały źródłowe: info.md, n8n.json

Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
2026-06-24 22:03:32 +02:00

188 lines
11 KiB
Markdown
Raw Blame History

This file contains invisible Unicode characters

This file contains invisible Unicode characters that are indistinguishable to humans but may be processed differently by a computer. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# Pytania do koncepcji AdReactions (v0.2)
> Lista kwestii wymagających decyzji właściciela produktu. Pytania wynikają z analizy
> dokumentów źródłowych projektu i ich wzajemnych **rozbieżności oraz luk**. Każde pytanie
> ma kontekst, proponowaną odpowiedź roboczą (do akceptacji/zmiany) i odwołanie do sekcji
> w `Koncepcja 0.2 - rozszerzona.md`.
>
> Pogrupowano wg priorytetu wpływu na zakres MVP.
---
## 🔴 Priorytet 1 — przesądzają o zakresie i wiarygodności MVP
### Q1. Facial Coding w MVP — jest czy nie ma?
**Kontekst:** Katalog celów i kreator zakładają analizę **FC / ET+FC** (walencja, pobudzenie,
frustracja, ambiwalencja, komfort…). Tymczasem specyfikacja procesu AI obejmuje obecnie
wyłącznie detekcję obiektów i predykcję uwagi (saliency); **mapa emocji jest pozycją roadmapy
(§11 specyfikacji)** — nie ma jeszcze modelu Facial Coding.
**Pytanie:** Czy MVP 1.0 ma realnie liczyć metryki Facial Coding? Jeśli tak — jaki model/usługa
je dostarczy i kiedy będzie dostępny? Jeśli nie — czy ukrywamy opcje FC/ET+FC, czy pokazujemy je
jako „wkrótce"?
**Propozycja robocza:** MVP dostarcza **ET (saliency statyczna)**; opcje FC oznaczone „wkrótce".
*(§9.4, §9.5, §18)*
### Q2. Wymiar czasu — „czas obserwacji 120s", mapy dynamiczne, scanpath
**Kontekst:** Obecne modele zwracają **jedną, statyczną** mapę uwagi. Raport zakłada
„wizualizacje statyczne 1/3/5/10/15/20s", „mapy dynamiczne 120s" i „ścieżki fiksacji" —
wszystko to wymaga **saliency czasowej / scanpath**, które są w roadmapie.
**Pytanie:** Czy parametr „czas obserwacji" i wizualizacje czasowe są w zakresie MVP? Jeśli nie —
czy pokazujemy pojedynczą mapę zagregowaną i ukrywamy oś czasu?
**Propozycja robocza:** MVP = jedna mapa statyczna; oś czasu w roadmapie. *(§7.2, §9.5, §11.1)*
### Q3. Predykcje per grupa docelowa — jak technicznie?
**Kontekst:** Kreator zbiera bogaty profil grupy (wiek, płeć, miejsce, wykształcenie, dochód,
neuroatypowość, presety). `Opis celów…` zakłada, że ASM PNS generuje **różne predykcje dla
różnych segmentów**. Ale pipeline **nie przyjmuje demografii na wejściu** — żaden endpoint nie
ma takiego parametru.
**Pytanie:** Jak grupa docelowa ma wpływać na wynik? Opcje: (a) przez `prompt` modelu ASM,
(b) osobne wagi/warianty modelu per segment, (c) w MVP grupa jest tylko **metadanymi raportu**
bez wpływu na predykcję.
**Propozycja robocza:** w MVP (c) — grupa opisuje kontekst i interpretację, nie zmienia mapy
uwagi; różnicowanie per segment → roadmapa. *(§7.1, §9.4, §9.5)*
### Q4. „Analiza kognitywna" (rekomendacja z uzasadnieniem) — kto/co ją generuje?
**Kontekst:** Rdzeń wartości produktu to zdanie typu „Wariant B wygrywa, ponieważ…". To **nowy
komponent** (warstwa interpretacji LLM nad metrykami) — nie istnieje w pipeline.
**Pytanie:** Czy budujemy tę warstwę w MVP? Jaki model ją realizuje (ASM? publiczny LLM?), na
jakich danych wejściowych (metryki + cel + grupa), z jakimi zabezpieczeniami przed „halucynacją"
rekomendacji?
**Propozycja robocza:** TAK, to priorytet MVP; realizacja przez LLM z **ustrukturyzowanym
wejściem** (policzone metryki), nie przez „opowieść" o obrazie. *(§9.4, §11.1, §18)*
### Q5. Zakres celów w MVP
**Kontekst:** 15 celów; większość rekomenduje **ET+FC**. Bez FC i wymiaru czasu część celów
nie jest w pełni wykonalna (§9.5).
**Pytanie:** Które z 15 celów udostępniamy w MVP 1.0?
**Propozycja robocza:** start od celów silnie ET (#2, #7, #1, #3), reszta „wkrótce". *(§8, §18)*
---
## 🟠 Priorytet 2 — architektura i wymienialność modeli
### Q6. Warstwa metryk — potwierdzenie zakresu i miejsca liczenia
**Kontekst:** Metryki „udziału uwagi na AOI" powstają z **przecięcia map saliency z obszarami
AOI** — to komponent backendu, a nie wynik zwracany przez modele (modele dostarczają mapy uwagi).
**Pytanie:** Potwierdzamy, że backend liczy metryki z map saliency (saliency ∩ AOI), a modele
dostarczają wyłącznie mapy? Jaka jest dokładna lista wskaźników w MVP?
**Propozycja robocza:** tak; MVP liczy udział uwagi na AOI, ranking AOI i porównanie wariantów
(zakres ET-static). *(§9.5, §11.1)*
### Q7. Zakres wymienialności modeli (info.md)
**Kontekst:** Wymóg: zmiana modelu na inny (Gemini, Opus). Modele saliency/FC są jednak
wyspecjalizowane — publiczny LLM nie zastąpi ich 1:1.
**Pytanie:** Które procesy mają być wymienialne w MVP? Tylko „rozumienie treści” (etykiety/opis:
LLaVA↔Gemini/Opus), czy też predykcja uwagi (co wymaga modeli saliency innego dostawcy)?
**Propozycja robocza:** wymienialność w MVP dla procesów językowo-wizualnych; predykcja uwagi
pozostaje na modelach własnych (ASM jako rdzeń). *(§10.1, §10.4)*
### Q8. Konfiguracja modeli — gdzie i jak zarządzana?
**Kontekst:** Konfiguracja modeli (hosty, token/klucz, parametry) nie powinna być zaszyta w
kodzie ani w konfiguracji testowej — w MVP zarządzana z panelu administracyjnego.
**Pytanie:** Czy akceptujemy model „Proces ↔ Model" z adapterami, konfiguracją sekretów w panelu,
testem połączenia i wersjonowaniem przypisania (dla audytu, który model policzył raport)?
**Propozycja robocza:** TAK (§10.210.3, encje `ai_processes` / `ai_models` /
`process_model_binding` w §12). *(§10, §12)*
### Q9. Obiekty vs AOI — skąd biorą się AOI semantyczne?
**Kontekst:** Pipeline wykrywa **obiekty** (LLaVA+DINO). AOI to **obszary marketingowe**
(CTA, Logo…). To inna kategoria niż „osoba/butelka".
**Pytanie:** AOI w MVP są: (a) wyłącznie ręczne (Studio), (b) AI sugeruje AOI osobnym modelem,
(c) mapowane heurystycznie z wykrytych obiektów?
**Propozycja robocza:** MVP — AOI ręczne + ewentualne podpowiedzi z obiektów; pełna „AI-detekcja
AOI” to osobny model. *(§7.3, §11.1)*
---
## 🟡 Priorytet 3 — spójność dokumentów i reguły produktowe
### Q10. Typy testu: A/AB/ABC czy A/AB/AC/BC/ABC?
**Kontekst:** Koncepcja 0.1 raz podaje **A/AB/ABC** (Krok 2), a w use case 2 i `Opis celów…`
pojawia się **A/AB/AC/BC/ABC**.
**Pytanie:** Który zestaw obowiązuje? Czy potrzebne są wszystkie pary (AC, BC), czy slot A/B/C
jest stały?
**Propozycja robocza:** pełny zestaw A/AB/AC/BC/ABC (większa elastyczność porównań). *(§7.2)*
### Q11. Próg wieku „Seniorzy"
**Kontekst:** W jednym miejscu „Seniorzy (66 i więcej)”, opis grup mówi „Dorośli 2664” →
luka 65 lat.
**Pytanie:** Ustalić progi bez luki (proponowane: Senior **65+**). *(§7.1)*
### Q12. Limit „jednej nowej organizacji" na użytkownika
**Kontekst:** „może dodać tylko jedną nową organizację”.
**Pytanie:** Czy to limit **zakładanych** organizacji (1 własna), czy łącznej **przynależności**?
Czy użytkownik może należeć do wielu organizacji przez zaproszenia?
**Propozycja robocza:** użytkownik zakłada max 1 organizację, ale może być członkiem wielu przez
zaproszenia. *(§3, §5, §6.2)*
### Q13. Rola „Gość" — zakres
**Kontekst:** Gość wymieniony w strukturze, bez zdefiniowanych uprawnień.
**Pytanie:** Co może gość? Propozycja: tylko podgląd udostępnionych raportów, bez tworzenia treści
i bez dostępu do rozliczeń. *(§5.1, §5.2)*
### Q14. Role projektowe — ujednolicenie
**Kontekst:** Koncepcja wymienia różne warianty („Editor/Viewer” oraz „usuwanie/edycja/
zapraszanie / edycja/zapraszanie / przeglądanie”).
**Pytanie:** Ile ról projektowych i jakie dokładnie uprawnienia? Propozycja: **Editor** /
**Viewer** (+ ewentualnie **Manager** z prawem usuwania i zarządzania dostępem). *(§5.2)*
---
## 🟢 Priorytet 4 — rozliczenia, eksport, prawne, i18n
### Q15. Model rozliczeń (kredyty/coiny)
**Pytanie:** Cennik eksperymentu (zależny od ET/FC/ET+FC i liczby kreacji?), zasady kredytów
miesięcznych vs globalnych, wygasanie, zachowanie przy przekroczeniu limitu, fakturowanie.
Brak danych w źródłach. *(§13)*
### Q16. Plany subskrypcji i przestrzeń dyskowa
**Pytanie:** Jakie plany (nazwy, limity, ceny)? Cennik rozszerzenia dysku w kredytach? *(§13)*
### Q17. Eksport XLS / AVI
**Kontekst:** Use case 2 wymaga XLS (tabele metryk) i AVI (dynamiczne mapy/ścieżki).
**Pytanie:** Czy w MVP? AVI zależy od wizualizacji czasowych (Q2). Propozycja: PDF w MVP;
XLS gdy są metryki tabelaryczne; AVI z roadmapą czasową. *(§11.3)*
### Q18. Udostępnianie raportu linkiem — publiczne czy z logowaniem?
**Pytanie:** „Link do eksperymentu” to dostęp publiczny (każdy z linkiem), czy wymaga konta i
nadanej roli (Editor/Viewer)? Implikacje dla bezpieczeństwa treści klienta. *(§11.3, §15)*
### Q19. Dane wysyłane do modeli publicznych (Gemini/Opus)
**Kontekst:** Podmiana na publiczny model = kreacje opuszczają infrastrukturę własną.
**Pytanie:** Czy wymagana zgoda klienta / oznaczenie w organizacji, że dany proces korzysta z
modelu zewnętrznego? *(§10.4, §15)*
### Q20. Kategoria „neuroatypowość” — komunikacja i zgodność
**Pytanie:** Jak prezentować wyniki dla profili ASD/ADHD/depresja, by nie sugerować diagnozy?
Czy model w ogóle różnicuje predykcje wg neuroatypowości (powiązane z Q3)? *(§7.1, §15)*
### Q21. Język raportu i interpretacji
**Pytanie:** Czy tekst rekomendacji (warstwa kognitywna) podąża za locale użytkownika (PL/EN)?
Czy prompt ASM zależy od języka, czy pozostaje stały (obecnie EN)? *(§16)*
---
## Pytania uzupełniające (do potwierdzenia kontraktów)
### Q22. Kontrakty odpowiedzi usług AI
W `Specyfikacja-procesu-AI.md` kształty odpowiedzi oznaczono „(wnioskowane)”. **Pytanie:** Czy
istnieje dokumentacja/realne odpowiedzi usług (LLaVA, DINO, DeepGaze, UNISAL, ASM) do
potwierdzenia pól (`labels`, `objects_bboxes`, `heatmap_b64`, `data`, `image_detailed/general`)?
### Q23. Model ASM PNS — faktyczny zakres
**Kontekst:** ASM zwraca **2 mapy uwagi** (detailed/general), ale `Opis celów…` przypisuje mu też
predykcję **pobudzenia emocjonalnego / zapamiętywalności**. **Pytanie:** Co dokładnie ASM PNS
potrafi dziś, a co jest planem? Czy „detailed/general” odpowiadają jakimś pojęciom produktowym?
### Q24. Hosting i dostępność modeli
**Kontekst:** UNISAL i ASM współdzielą jeden host (`1.208.108.242:58951`).
**Pytanie:** Jaka jest docelowa infrastruktura produkcyjna (SLA, skalowanie, lokalizacja danych)?
### Q25. „Ścieżka AOI” w MVP — przybliżenie czy nic?
**Pytanie:** Czy akceptujemy przybliżenie „ścieżki AOI” rankingiem AOI wg intensywności saliency
(z adnotacją, że to nie jest prawdziwy scanpath), czy komponent czeka na model scanpath? *(§9.5)*
---
*Po decyzjach: zaktualizować odpowiednie sekcje `Koncepcja 0.2 - rozszerzona.md` i usunąć
znaczniki [?].*