189 lines
11 KiB
Markdown
189 lines
11 KiB
Markdown
|
|
# Pytania do koncepcji AdReactions (v0.2)
|
|||
|
|
|
|||
|
|
> Lista kwestii wymagających decyzji właściciela produktu. Pytania wynikają z analizy
|
|||
|
|
> dokumentów źródłowych projektu i ich wzajemnych **rozbieżności oraz luk**. Każde pytanie
|
|||
|
|
> ma kontekst, proponowaną odpowiedź roboczą (do akceptacji/zmiany) i odwołanie do sekcji
|
|||
|
|
> w `Koncepcja 0.2 - rozszerzona.md`.
|
|||
|
|
>
|
|||
|
|
> Pogrupowano wg priorytetu wpływu na zakres MVP.
|
|||
|
|
|
|||
|
|
---
|
|||
|
|
|
|||
|
|
## 🔴 Priorytet 1 — przesądzają o zakresie i wiarygodności MVP
|
|||
|
|
|
|||
|
|
### Q1. Facial Coding w MVP — jest czy nie ma?
|
|||
|
|
**Kontekst:** Katalog celów i kreator zakładają analizę **FC / ET+FC** (walencja, pobudzenie,
|
|||
|
|
frustracja, ambiwalencja, komfort…). Tymczasem specyfikacja procesu AI obejmuje obecnie
|
|||
|
|
wyłącznie detekcję obiektów i predykcję uwagi (saliency); **mapa emocji jest pozycją roadmapy
|
|||
|
|
(§11 specyfikacji)** — nie ma jeszcze modelu Facial Coding.
|
|||
|
|
**Pytanie:** Czy MVP 1.0 ma realnie liczyć metryki Facial Coding? Jeśli tak — jaki model/usługa
|
|||
|
|
je dostarczy i kiedy będzie dostępny? Jeśli nie — czy ukrywamy opcje FC/ET+FC, czy pokazujemy je
|
|||
|
|
jako „wkrótce"?
|
|||
|
|
**Propozycja robocza:** MVP dostarcza **ET (saliency statyczna)**; opcje FC oznaczone „wkrótce".
|
|||
|
|
*(§9.4, §9.5, §18)*
|
|||
|
|
|
|||
|
|
### Q2. Wymiar czasu — „czas obserwacji 1–20s", mapy dynamiczne, scanpath
|
|||
|
|
**Kontekst:** Obecne modele zwracają **jedną, statyczną** mapę uwagi. Raport zakłada
|
|||
|
|
„wizualizacje statyczne 1/3/5/10/15/20s", „mapy dynamiczne 1–20s" i „ścieżki fiksacji" —
|
|||
|
|
wszystko to wymaga **saliency czasowej / scanpath**, które są w roadmapie.
|
|||
|
|
**Pytanie:** Czy parametr „czas obserwacji" i wizualizacje czasowe są w zakresie MVP? Jeśli nie —
|
|||
|
|
czy pokazujemy pojedynczą mapę zagregowaną i ukrywamy oś czasu?
|
|||
|
|
**Propozycja robocza:** MVP = jedna mapa statyczna; oś czasu w roadmapie. *(§7.2, §9.5, §11.1)*
|
|||
|
|
|
|||
|
|
### Q3. Predykcje per grupa docelowa — jak technicznie?
|
|||
|
|
**Kontekst:** Kreator zbiera bogaty profil grupy (wiek, płeć, miejsce, wykształcenie, dochód,
|
|||
|
|
neuroatypowość, presety). `Opis celów…` zakłada, że ASM PNS generuje **różne predykcje dla
|
|||
|
|
różnych segmentów**. Ale pipeline **nie przyjmuje demografii na wejściu** — żaden endpoint nie
|
|||
|
|
ma takiego parametru.
|
|||
|
|
**Pytanie:** Jak grupa docelowa ma wpływać na wynik? Opcje: (a) przez `prompt` modelu ASM,
|
|||
|
|
(b) osobne wagi/warianty modelu per segment, (c) w MVP grupa jest tylko **metadanymi raportu**
|
|||
|
|
bez wpływu na predykcję.
|
|||
|
|
**Propozycja robocza:** w MVP (c) — grupa opisuje kontekst i interpretację, nie zmienia mapy
|
|||
|
|
uwagi; różnicowanie per segment → roadmapa. *(§7.1, §9.4, §9.5)*
|
|||
|
|
|
|||
|
|
### Q4. „Analiza kognitywna" (rekomendacja z uzasadnieniem) — kto/co ją generuje?
|
|||
|
|
**Kontekst:** Rdzeń wartości produktu to zdanie typu „Wariant B wygrywa, ponieważ…". To **nowy
|
|||
|
|
komponent** (warstwa interpretacji LLM nad metrykami) — nie istnieje w pipeline.
|
|||
|
|
**Pytanie:** Czy budujemy tę warstwę w MVP? Jaki model ją realizuje (ASM? publiczny LLM?), na
|
|||
|
|
jakich danych wejściowych (metryki + cel + grupa), z jakimi zabezpieczeniami przed „halucynacją"
|
|||
|
|
rekomendacji?
|
|||
|
|
**Propozycja robocza:** TAK, to priorytet MVP; realizacja przez LLM z **ustrukturyzowanym
|
|||
|
|
wejściem** (policzone metryki), nie przez „opowieść" o obrazie. *(§9.4, §11.1, §18)*
|
|||
|
|
|
|||
|
|
### Q5. Zakres celów w MVP
|
|||
|
|
**Kontekst:** 15 celów; większość rekomenduje **ET+FC**. Bez FC i wymiaru czasu część celów
|
|||
|
|
nie jest w pełni wykonalna (§9.5).
|
|||
|
|
**Pytanie:** Które z 15 celów udostępniamy w MVP 1.0?
|
|||
|
|
**Propozycja robocza:** start od celów silnie ET (#2, #7, #1, #3), reszta „wkrótce". *(§8, §18)*
|
|||
|
|
|
|||
|
|
---
|
|||
|
|
|
|||
|
|
## 🟠 Priorytet 2 — architektura i wymienialność modeli
|
|||
|
|
|
|||
|
|
### Q6. Warstwa metryk — potwierdzenie zakresu i miejsca liczenia
|
|||
|
|
**Kontekst:** Metryki „udziału uwagi na AOI" powstają z **przecięcia map saliency z obszarami
|
|||
|
|
AOI** — to komponent backendu, a nie wynik zwracany przez modele (modele dostarczają mapy uwagi).
|
|||
|
|
**Pytanie:** Potwierdzamy, że backend liczy metryki z map saliency (saliency ∩ AOI), a modele
|
|||
|
|
dostarczają wyłącznie mapy? Jaka jest dokładna lista wskaźników w MVP?
|
|||
|
|
**Propozycja robocza:** tak; MVP liczy udział uwagi na AOI, ranking AOI i porównanie wariantów
|
|||
|
|
(zakres ET-static). *(§9.5, §11.1)*
|
|||
|
|
|
|||
|
|
### Q7. Zakres wymienialności modeli (info.md)
|
|||
|
|
**Kontekst:** Wymóg: zmiana modelu na inny (Gemini, Opus). Modele saliency/FC są jednak
|
|||
|
|
wyspecjalizowane — publiczny LLM nie zastąpi ich 1:1.
|
|||
|
|
**Pytanie:** Które procesy mają być wymienialne w MVP? Tylko „rozumienie treści” (etykiety/opis:
|
|||
|
|
LLaVA↔Gemini/Opus), czy też predykcja uwagi (co wymaga modeli saliency innego dostawcy)?
|
|||
|
|
**Propozycja robocza:** wymienialność w MVP dla procesów językowo-wizualnych; predykcja uwagi
|
|||
|
|
pozostaje na modelach własnych (ASM jako rdzeń). *(§10.1, §10.4)*
|
|||
|
|
|
|||
|
|
### Q8. Konfiguracja modeli — gdzie i jak zarządzana?
|
|||
|
|
**Kontekst:** Konfiguracja modeli (hosty, token/klucz, parametry) nie powinna być zaszyta w
|
|||
|
|
kodzie ani w konfiguracji testowej — w MVP zarządzana z panelu administracyjnego.
|
|||
|
|
**Pytanie:** Czy akceptujemy model „Proces ↔ Model" z adapterami, konfiguracją sekretów w panelu,
|
|||
|
|
testem połączenia i wersjonowaniem przypisania (dla audytu, który model policzył raport)?
|
|||
|
|
**Propozycja robocza:** TAK (§10.2–10.3, encje `ai_processes` / `ai_models` /
|
|||
|
|
`process_model_binding` w §12). *(§10, §12)*
|
|||
|
|
|
|||
|
|
### Q9. Obiekty vs AOI — skąd biorą się AOI semantyczne?
|
|||
|
|
**Kontekst:** Pipeline wykrywa **obiekty** (LLaVA+DINO). AOI to **obszary marketingowe**
|
|||
|
|
(CTA, Logo…). To inna kategoria niż „osoba/butelka".
|
|||
|
|
**Pytanie:** AOI w MVP są: (a) wyłącznie ręczne (Studio), (b) AI sugeruje AOI osobnym modelem,
|
|||
|
|
(c) mapowane heurystycznie z wykrytych obiektów?
|
|||
|
|
**Propozycja robocza:** MVP — AOI ręczne + ewentualne podpowiedzi z obiektów; pełna „AI-detekcja
|
|||
|
|
AOI” to osobny model. *(§7.3, §11.1)*
|
|||
|
|
|
|||
|
|
---
|
|||
|
|
|
|||
|
|
## 🟡 Priorytet 3 — spójność dokumentów i reguły produktowe
|
|||
|
|
|
|||
|
|
### Q10. Typy testu: A/AB/ABC czy A/AB/AC/BC/ABC?
|
|||
|
|
**Kontekst:** Koncepcja 0.1 raz podaje **A/AB/ABC** (Krok 2), a w use case 2 i `Opis celów…`
|
|||
|
|
pojawia się **A/AB/AC/BC/ABC**.
|
|||
|
|
**Pytanie:** Który zestaw obowiązuje? Czy potrzebne są wszystkie pary (AC, BC), czy slot A/B/C
|
|||
|
|
jest stały?
|
|||
|
|
**Propozycja robocza:** pełny zestaw A/AB/AC/BC/ABC (większa elastyczność porównań). *(§7.2)*
|
|||
|
|
|
|||
|
|
### Q11. Próg wieku „Seniorzy"
|
|||
|
|
**Kontekst:** W jednym miejscu „Seniorzy (66 i więcej)”, opis grup mówi „Dorośli 26–64” →
|
|||
|
|
luka 65 lat.
|
|||
|
|
**Pytanie:** Ustalić progi bez luki (proponowane: Senior **65+**). *(§7.1)*
|
|||
|
|
|
|||
|
|
### Q12. Limit „jednej nowej organizacji" na użytkownika
|
|||
|
|
**Kontekst:** „może dodać tylko jedną nową organizację”.
|
|||
|
|
**Pytanie:** Czy to limit **zakładanych** organizacji (1 własna), czy łącznej **przynależności**?
|
|||
|
|
Czy użytkownik może należeć do wielu organizacji przez zaproszenia?
|
|||
|
|
**Propozycja robocza:** użytkownik zakłada max 1 organizację, ale może być członkiem wielu przez
|
|||
|
|
zaproszenia. *(§3, §5, §6.2)*
|
|||
|
|
|
|||
|
|
### Q13. Rola „Gość" — zakres
|
|||
|
|
**Kontekst:** Gość wymieniony w strukturze, bez zdefiniowanych uprawnień.
|
|||
|
|
**Pytanie:** Co może gość? Propozycja: tylko podgląd udostępnionych raportów, bez tworzenia treści
|
|||
|
|
i bez dostępu do rozliczeń. *(§5.1, §5.2)*
|
|||
|
|
|
|||
|
|
### Q14. Role projektowe — ujednolicenie
|
|||
|
|
**Kontekst:** Koncepcja wymienia różne warianty („Editor/Viewer” oraz „usuwanie/edycja/
|
|||
|
|
zapraszanie / edycja/zapraszanie / przeglądanie”).
|
|||
|
|
**Pytanie:** Ile ról projektowych i jakie dokładnie uprawnienia? Propozycja: **Editor** /
|
|||
|
|
**Viewer** (+ ewentualnie **Manager** z prawem usuwania i zarządzania dostępem). *(§5.2)*
|
|||
|
|
|
|||
|
|
---
|
|||
|
|
|
|||
|
|
## 🟢 Priorytet 4 — rozliczenia, eksport, prawne, i18n
|
|||
|
|
|
|||
|
|
### Q15. Model rozliczeń (kredyty/coiny)
|
|||
|
|
**Pytanie:** Cennik eksperymentu (zależny od ET/FC/ET+FC i liczby kreacji?), zasady kredytów
|
|||
|
|
miesięcznych vs globalnych, wygasanie, zachowanie przy przekroczeniu limitu, fakturowanie.
|
|||
|
|
Brak danych w źródłach. *(§13)*
|
|||
|
|
|
|||
|
|
### Q16. Plany subskrypcji i przestrzeń dyskowa
|
|||
|
|
**Pytanie:** Jakie plany (nazwy, limity, ceny)? Cennik rozszerzenia dysku w kredytach? *(§13)*
|
|||
|
|
|
|||
|
|
### Q17. Eksport XLS / AVI
|
|||
|
|
**Kontekst:** Use case 2 wymaga XLS (tabele metryk) i AVI (dynamiczne mapy/ścieżki).
|
|||
|
|
**Pytanie:** Czy w MVP? AVI zależy od wizualizacji czasowych (Q2). Propozycja: PDF w MVP;
|
|||
|
|
XLS gdy są metryki tabelaryczne; AVI z roadmapą czasową. *(§11.3)*
|
|||
|
|
|
|||
|
|
### Q18. Udostępnianie raportu linkiem — publiczne czy z logowaniem?
|
|||
|
|
**Pytanie:** „Link do eksperymentu” to dostęp publiczny (każdy z linkiem), czy wymaga konta i
|
|||
|
|
nadanej roli (Editor/Viewer)? Implikacje dla bezpieczeństwa treści klienta. *(§11.3, §15)*
|
|||
|
|
|
|||
|
|
### Q19. Dane wysyłane do modeli publicznych (Gemini/Opus)
|
|||
|
|
**Kontekst:** Podmiana na publiczny model = kreacje opuszczają infrastrukturę własną.
|
|||
|
|
**Pytanie:** Czy wymagana zgoda klienta / oznaczenie w organizacji, że dany proces korzysta z
|
|||
|
|
modelu zewnętrznego? *(§10.4, §15)*
|
|||
|
|
|
|||
|
|
### Q20. Kategoria „neuroatypowość” — komunikacja i zgodność
|
|||
|
|
**Pytanie:** Jak prezentować wyniki dla profili ASD/ADHD/depresja, by nie sugerować diagnozy?
|
|||
|
|
Czy model w ogóle różnicuje predykcje wg neuroatypowości (powiązane z Q3)? *(§7.1, §15)*
|
|||
|
|
|
|||
|
|
### Q21. Język raportu i interpretacji
|
|||
|
|
**Pytanie:** Czy tekst rekomendacji (warstwa kognitywna) podąża za locale użytkownika (PL/EN)?
|
|||
|
|
Czy prompt ASM zależy od języka, czy pozostaje stały (obecnie EN)? *(§16)*
|
|||
|
|
|
|||
|
|
---
|
|||
|
|
|
|||
|
|
## ℹ️ Pytania uzupełniające (do potwierdzenia kontraktów)
|
|||
|
|
|
|||
|
|
### Q22. Kontrakty odpowiedzi usług AI
|
|||
|
|
W `Specyfikacja-procesu-AI.md` kształty odpowiedzi oznaczono „(wnioskowane)”. **Pytanie:** Czy
|
|||
|
|
istnieje dokumentacja/realne odpowiedzi usług (LLaVA, DINO, DeepGaze, UNISAL, ASM) do
|
|||
|
|
potwierdzenia pól (`labels`, `objects_bboxes`, `heatmap_b64`, `data`, `image_detailed/general`)?
|
|||
|
|
|
|||
|
|
### Q23. Model ASM PNS — faktyczny zakres
|
|||
|
|
**Kontekst:** ASM zwraca **2 mapy uwagi** (detailed/general), ale `Opis celów…` przypisuje mu też
|
|||
|
|
predykcję **pobudzenia emocjonalnego / zapamiętywalności**. **Pytanie:** Co dokładnie ASM PNS
|
|||
|
|
potrafi dziś, a co jest planem? Czy „detailed/general” odpowiadają jakimś pojęciom produktowym?
|
|||
|
|
|
|||
|
|
### Q24. Hosting i dostępność modeli
|
|||
|
|
**Kontekst:** UNISAL i ASM współdzielą jeden host (`1.208.108.242:58951`).
|
|||
|
|
**Pytanie:** Jaka jest docelowa infrastruktura produkcyjna (SLA, skalowanie, lokalizacja danych)?
|
|||
|
|
|
|||
|
|
### Q25. „Ścieżka AOI” w MVP — przybliżenie czy nic?
|
|||
|
|
**Pytanie:** Czy akceptujemy przybliżenie „ścieżki AOI” rankingiem AOI wg intensywności saliency
|
|||
|
|
(z adnotacją, że to nie jest prawdziwy scanpath), czy komponent czeka na model scanpath? *(§9.5)*
|
|||
|
|
|
|||
|
|
---
|
|||
|
|
|
|||
|
|
*Po decyzjach: zaktualizować odpowiednie sekcje `Koncepcja 0.2 - rozszerzona.md` i usunąć
|
|||
|
|
znaczniki [?].*
|