ASM_PNS_C/Pytania do koncepcji.md
majkarol cd292e3198 Inicjalizacja repozytorium: koncepcja platformy AdReactions + specyfikacja AI
Zawartość:
- Koncepcja 0.1 oraz rozszerzona Koncepcja 0.2 (model domenowy, architektura,
  mapowanie cel→metryki→usługi AI, wymienialność modeli, model danych)
- Katalog 15 celów analiz kognitywnych
- Specyfikacja procesu AI + opis procesów źródłowych
- Pytania do koncepcji
- Materiały źródłowe: info.md, n8n.json

Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
2026-06-24 22:03:32 +02:00

11 KiB
Raw Blame History

Pytania do koncepcji AdReactions (v0.2)

Lista kwestii wymagających decyzji właściciela produktu. Pytania wynikają z analizy dokumentów źródłowych projektu i ich wzajemnych rozbieżności oraz luk. Każde pytanie ma kontekst, proponowaną odpowiedź roboczą (do akceptacji/zmiany) i odwołanie do sekcji w Koncepcja 0.2 - rozszerzona.md.

Pogrupowano wg priorytetu wpływu na zakres MVP.


🔴 Priorytet 1 — przesądzają o zakresie i wiarygodności MVP

Q1. Facial Coding w MVP — jest czy nie ma?

Kontekst: Katalog celów i kreator zakładają analizę FC / ET+FC (walencja, pobudzenie, frustracja, ambiwalencja, komfort…). Tymczasem specyfikacja procesu AI obejmuje obecnie wyłącznie detekcję obiektów i predykcję uwagi (saliency); mapa emocji jest pozycją roadmapy (§11 specyfikacji) — nie ma jeszcze modelu Facial Coding. Pytanie: Czy MVP 1.0 ma realnie liczyć metryki Facial Coding? Jeśli tak — jaki model/usługa je dostarczy i kiedy będzie dostępny? Jeśli nie — czy ukrywamy opcje FC/ET+FC, czy pokazujemy je jako „wkrótce"? Propozycja robocza: MVP dostarcza ET (saliency statyczna); opcje FC oznaczone „wkrótce". (§9.4, §9.5, §18)

Q2. Wymiar czasu — „czas obserwacji 120s", mapy dynamiczne, scanpath

Kontekst: Obecne modele zwracają jedną, statyczną mapę uwagi. Raport zakłada „wizualizacje statyczne 1/3/5/10/15/20s", „mapy dynamiczne 120s" i „ścieżki fiksacji" — wszystko to wymaga saliency czasowej / scanpath, które są w roadmapie. Pytanie: Czy parametr „czas obserwacji" i wizualizacje czasowe są w zakresie MVP? Jeśli nie — czy pokazujemy pojedynczą mapę zagregowaną i ukrywamy oś czasu? Propozycja robocza: MVP = jedna mapa statyczna; oś czasu w roadmapie. (§7.2, §9.5, §11.1)

Q3. Predykcje per grupa docelowa — jak technicznie?

Kontekst: Kreator zbiera bogaty profil grupy (wiek, płeć, miejsce, wykształcenie, dochód, neuroatypowość, presety). Opis celów… zakłada, że ASM PNS generuje różne predykcje dla różnych segmentów. Ale pipeline nie przyjmuje demografii na wejściu — żaden endpoint nie ma takiego parametru. Pytanie: Jak grupa docelowa ma wpływać na wynik? Opcje: (a) przez prompt modelu ASM, (b) osobne wagi/warianty modelu per segment, (c) w MVP grupa jest tylko metadanymi raportu bez wpływu na predykcję. Propozycja robocza: w MVP (c) — grupa opisuje kontekst i interpretację, nie zmienia mapy uwagi; różnicowanie per segment → roadmapa. (§7.1, §9.4, §9.5)

Q4. „Analiza kognitywna" (rekomendacja z uzasadnieniem) — kto/co ją generuje?

Kontekst: Rdzeń wartości produktu to zdanie typu „Wariant B wygrywa, ponieważ…". To nowy komponent (warstwa interpretacji LLM nad metrykami) — nie istnieje w pipeline. Pytanie: Czy budujemy tę warstwę w MVP? Jaki model ją realizuje (ASM? publiczny LLM?), na jakich danych wejściowych (metryki + cel + grupa), z jakimi zabezpieczeniami przed „halucynacją" rekomendacji? Propozycja robocza: TAK, to priorytet MVP; realizacja przez LLM z ustrukturyzowanym wejściem (policzone metryki), nie przez „opowieść" o obrazie. (§9.4, §11.1, §18)

Q5. Zakres celów w MVP

Kontekst: 15 celów; większość rekomenduje ET+FC. Bez FC i wymiaru czasu część celów nie jest w pełni wykonalna (§9.5). Pytanie: Które z 15 celów udostępniamy w MVP 1.0? Propozycja robocza: start od celów silnie ET (#2, #7, #1, #3), reszta „wkrótce". (§8, §18)


🟠 Priorytet 2 — architektura i wymienialność modeli

Q6. Warstwa metryk — potwierdzenie zakresu i miejsca liczenia

Kontekst: Metryki „udziału uwagi na AOI" powstają z przecięcia map saliency z obszarami AOI — to komponent backendu, a nie wynik zwracany przez modele (modele dostarczają mapy uwagi). Pytanie: Potwierdzamy, że backend liczy metryki z map saliency (saliency ∩ AOI), a modele dostarczają wyłącznie mapy? Jaka jest dokładna lista wskaźników w MVP? Propozycja robocza: tak; MVP liczy udział uwagi na AOI, ranking AOI i porównanie wariantów (zakres ET-static). (§9.5, §11.1)

Q7. Zakres wymienialności modeli (info.md)

Kontekst: Wymóg: zmiana modelu na inny (Gemini, Opus). Modele saliency/FC są jednak wyspecjalizowane — publiczny LLM nie zastąpi ich 1:1. Pytanie: Które procesy mają być wymienialne w MVP? Tylko „rozumienie treści” (etykiety/opis: LLaVA↔Gemini/Opus), czy też predykcja uwagi (co wymaga modeli saliency innego dostawcy)? Propozycja robocza: wymienialność w MVP dla procesów językowo-wizualnych; predykcja uwagi pozostaje na modelach własnych (ASM jako rdzeń). (§10.1, §10.4)

Q8. Konfiguracja modeli — gdzie i jak zarządzana?

Kontekst: Konfiguracja modeli (hosty, token/klucz, parametry) nie powinna być zaszyta w kodzie ani w konfiguracji testowej — w MVP zarządzana z panelu administracyjnego. Pytanie: Czy akceptujemy model „Proces ↔ Model" z adapterami, konfiguracją sekretów w panelu, testem połączenia i wersjonowaniem przypisania (dla audytu, który model policzył raport)? Propozycja robocza: TAK (§10.210.3, encje ai_processes / ai_models / process_model_binding w §12). (§10, §12)

Q9. Obiekty vs AOI — skąd biorą się AOI semantyczne?

Kontekst: Pipeline wykrywa obiekty (LLaVA+DINO). AOI to obszary marketingowe (CTA, Logo…). To inna kategoria niż „osoba/butelka". Pytanie: AOI w MVP są: (a) wyłącznie ręczne (Studio), (b) AI sugeruje AOI osobnym modelem, (c) mapowane heurystycznie z wykrytych obiektów? Propozycja robocza: MVP — AOI ręczne + ewentualne podpowiedzi z obiektów; pełna „AI-detekcja AOI” to osobny model. (§7.3, §11.1)


🟡 Priorytet 3 — spójność dokumentów i reguły produktowe

Q10. Typy testu: A/AB/ABC czy A/AB/AC/BC/ABC?

Kontekst: Koncepcja 0.1 raz podaje A/AB/ABC (Krok 2), a w use case 2 i Opis celów… pojawia się A/AB/AC/BC/ABC. Pytanie: Który zestaw obowiązuje? Czy potrzebne są wszystkie pary (AC, BC), czy slot A/B/C jest stały? Propozycja robocza: pełny zestaw A/AB/AC/BC/ABC (większa elastyczność porównań). (§7.2)

Q11. Próg wieku „Seniorzy"

Kontekst: W jednym miejscu „Seniorzy (66 i więcej)”, opis grup mówi „Dorośli 2664” → luka 65 lat. Pytanie: Ustalić progi bez luki (proponowane: Senior 65+). (§7.1)

Q12. Limit „jednej nowej organizacji" na użytkownika

Kontekst: „może dodać tylko jedną nową organizację”. Pytanie: Czy to limit zakładanych organizacji (1 własna), czy łącznej przynależności? Czy użytkownik może należeć do wielu organizacji przez zaproszenia? Propozycja robocza: użytkownik zakłada max 1 organizację, ale może być członkiem wielu przez zaproszenia. (§3, §5, §6.2)

Q13. Rola „Gość" — zakres

Kontekst: Gość wymieniony w strukturze, bez zdefiniowanych uprawnień. Pytanie: Co może gość? Propozycja: tylko podgląd udostępnionych raportów, bez tworzenia treści i bez dostępu do rozliczeń. (§5.1, §5.2)

Q14. Role projektowe — ujednolicenie

Kontekst: Koncepcja wymienia różne warianty („Editor/Viewer” oraz „usuwanie/edycja/ zapraszanie / edycja/zapraszanie / przeglądanie”). Pytanie: Ile ról projektowych i jakie dokładnie uprawnienia? Propozycja: Editor / Viewer (+ ewentualnie Manager z prawem usuwania i zarządzania dostępem). (§5.2)


🟢 Priorytet 4 — rozliczenia, eksport, prawne, i18n

Q15. Model rozliczeń (kredyty/coiny)

Pytanie: Cennik eksperymentu (zależny od ET/FC/ET+FC i liczby kreacji?), zasady kredytów miesięcznych vs globalnych, wygasanie, zachowanie przy przekroczeniu limitu, fakturowanie. Brak danych w źródłach. (§13)

Q16. Plany subskrypcji i przestrzeń dyskowa

Pytanie: Jakie plany (nazwy, limity, ceny)? Cennik rozszerzenia dysku w kredytach? (§13)

Q17. Eksport XLS / AVI

Kontekst: Use case 2 wymaga XLS (tabele metryk) i AVI (dynamiczne mapy/ścieżki). Pytanie: Czy w MVP? AVI zależy od wizualizacji czasowych (Q2). Propozycja: PDF w MVP; XLS gdy są metryki tabelaryczne; AVI z roadmapą czasową. (§11.3)

Q18. Udostępnianie raportu linkiem — publiczne czy z logowaniem?

Pytanie: „Link do eksperymentu” to dostęp publiczny (każdy z linkiem), czy wymaga konta i nadanej roli (Editor/Viewer)? Implikacje dla bezpieczeństwa treści klienta. (§11.3, §15)

Q19. Dane wysyłane do modeli publicznych (Gemini/Opus)

Kontekst: Podmiana na publiczny model = kreacje opuszczają infrastrukturę własną. Pytanie: Czy wymagana zgoda klienta / oznaczenie w organizacji, że dany proces korzysta z modelu zewnętrznego? (§10.4, §15)

Q20. Kategoria „neuroatypowość” — komunikacja i zgodność

Pytanie: Jak prezentować wyniki dla profili ASD/ADHD/depresja, by nie sugerować diagnozy? Czy model w ogóle różnicuje predykcje wg neuroatypowości (powiązane z Q3)? (§7.1, §15)

Q21. Język raportu i interpretacji

Pytanie: Czy tekst rekomendacji (warstwa kognitywna) podąża za locale użytkownika (PL/EN)? Czy prompt ASM zależy od języka, czy pozostaje stały (obecnie EN)? (§16)


Pytania uzupełniające (do potwierdzenia kontraktów)

Q22. Kontrakty odpowiedzi usług AI

W Specyfikacja-procesu-AI.md kształty odpowiedzi oznaczono „(wnioskowane)”. Pytanie: Czy istnieje dokumentacja/realne odpowiedzi usług (LLaVA, DINO, DeepGaze, UNISAL, ASM) do potwierdzenia pól (labels, objects_bboxes, heatmap_b64, data, image_detailed/general)?

Q23. Model ASM PNS — faktyczny zakres

Kontekst: ASM zwraca 2 mapy uwagi (detailed/general), ale Opis celów… przypisuje mu też predykcję pobudzenia emocjonalnego / zapamiętywalności. Pytanie: Co dokładnie ASM PNS potrafi dziś, a co jest planem? Czy „detailed/general” odpowiadają jakimś pojęciom produktowym?

Q24. Hosting i dostępność modeli

Kontekst: UNISAL i ASM współdzielą jeden host (1.208.108.242:58951). Pytanie: Jaka jest docelowa infrastruktura produkcyjna (SLA, skalowanie, lokalizacja danych)?

Q25. „Ścieżka AOI” w MVP — przybliżenie czy nic?

Pytanie: Czy akceptujemy przybliżenie „ścieżki AOI” rankingiem AOI wg intensywności saliency (z adnotacją, że to nie jest prawdziwy scanpath), czy komponent czeka na model scanpath? (§9.5)


Po decyzjach: zaktualizować odpowiednie sekcje Koncepcja 0.2 - rozszerzona.md i usunąć znaczniki [?].