We test how AI behaves with people.
Felixa Validate helps organizations understand how AI acts when it interacts with humans, tests its reliability in controlled contexts, and proves whether it performs as intended.
Sprawdzamy, jak AI zachowuje się wobec ludzi.
Felixa Validate pomaga organizacjom zrozumieć, jak AI działa w kontakcie z ludźmi, testuje jego niezawodność w kontrolowanych warunkach i dostarcza dowód, że działa zgodnie z założeniami.
Three clear services. One goal: AI you can trust.
Everything we do answers one question — does your AI behave the way people expect it to?
Trzy przejrzyste usługi. Jeden cel: AI, któremu można zaufać.
Wszystko, co robimy, odpowiada na jedno pytanie — czy Twoje AI zachowuje się tak, jak oczekują tego ludzie?
AI Behavioural Validation
We evaluate your AI system in controlled, realistic contexts, name every gap we find, revalidate once you have made changes, and certify the result.
Our core serviceWalidacja behawioralna AI
Oceniamy Twój system AI w kontrolowanych, realistycznych warunkach, nazywamy każdą znalezioną lukę, po Twoich zmianach walidujemy ponownie i certyfikujemy wynik.
Nasza główna usługaBehaviour Analytics & Research
We measure patterns, consistency, and reliability in how humans and AI behave — and compare AI performance against real human judgement.
Evidence, not opinionAnalityka behawioralna i badania
Mierzymy wzorce, spójność i niezawodność zachowań ludzi i AI — i porównujemy działanie AI z rzeczywistym ludzkim osądem.
Dowody, nie opinieWorkshops, Speaking & Partnerships
We help teams build behavioural understanding through workshops, talks, and long-term partnerships that grow your internal capability.
Separate from certificationWarsztaty, wystąpienia i partnerstwa
Pomagamy zespołom budować rozumienie zachowań poprzez warsztaty, wykłady i długofalowe partnerstwa, które wzmacniają kompetencje wewnątrz organizacji.
Osobno od certyfikacjiSix simple steps to a validated AI system.
You always know where you are in the process and what comes next.
Sześć prostych kroków do zwalidowanego systemu AI.
Zawsze wiesz, na jakim etapie procesu jesteś i co będzie dalej.
Scope
We define which system, which context, and which behaviours are being tested, and we agree the criteria before any testing starts.
Human validation
Trained independent raters judge the same material your AI judged, blind to its ratings.
Behaviour analytics
We measure agreement, consistency and directional bias across repeated sessions, attribute by attribute.
Findings report
We name every gap, rank it by severity, and state what the evidence shows. Your team or your chosen partner decides how to fix it.
Revalidation
Once changes are made, we test again against the same criteria.
Felixa Validate Certificate
You receive evidence that your AI system met Felixa Validate's criteria within the tested context.
Felixa ValidatedZakres
Ustalamy, który system, w jakim kontekście i które zachowania podlegają testom, oraz uzgadniamy kryteria przed rozpoczęciem badania.
Walidacja z udziałem ludzi
Przeszkoleni, niezależni oceniający oceniają ten sam materiał co Twoje AI, nie znając jego ocen.
Analityka behawioralna
Mierzymy zgodność, spójność i kierunek odchyleń w powtarzanych sesjach, atrybut po atrybucie.
Raport z ustaleniami
Nazywamy każdą lukę, porządkujemy ją według wagi i przedstawiamy, co pokazują dowody. O sposobie naprawy decyduje Twój zespół lub wybrany przez Ciebie partner.
Ponowna walidacja
Po wprowadzeniu zmian testujemy ponownie według tych samych kryteriów.
Certyfikat Felixa Validate
Otrzymujesz dowód, że Twój system AI spełnił kryteria walidacji Felixa Validate w testowanym kontekście.
Zwalidowane przez Felixa ValidateMost AI audits read your documents. We test your system.
Większość audytów AI czyta dokumenty. My testujemy system.
Document review
Auditors read your policies, your process documents and your own test results, interview your staff, and give an opinion on whether the paperwork holds up. No integration, no access to the system.
Przegląd dokumentacji
Audytorzy czytają polityki, dokumenty procesowe i Twoje własne wyniki testów, rozmawiają z zespołem i wydają opinię, czy dokumentacja się broni. Bez integracji, bez dostępu do systemu.
Behavioural testing
Trained raters judge the same material your AI judged, blind to its ratings. We measure the distance between them, attribute by attribute, and hand you the numbers.
Testowanie behawioralne
Przeszkoleni oceniający oceniają ten sam materiał co Twoje AI, nie znając jego ocen. Mierzymy odległość między nimi, atrybut po atrybucie, i przekazujemy Ci liczby.
Evidence you can act on, and a number your CFO understands.
Dowody, na których można działać, i liczba zrozumiała dla finansów.
You see exactly where your AI disagrees with people.
Our own peer-reviewed study found GPT-4o flags aggression at 37.6% where trained human raters say 17.4%, and detects empathy at 0.9% against a human rate of 9.2%. Your report names those gaps in your system, ranks them, and tells you what to change.
Widzisz dokładnie, gdzie Twoje AI różni się od ludzi.
Nasze zrecenzowane badanie wykazało, że GPT-4o wskazuje agresję w 37,6% przypadków, podczas gdy przeszkoleni oceniający mówią o 17,4%, a empatię wykrywa w 0,9% wobec 9,2% u ludzi. Twój raport nazywa te luki w Twoim systemie, porządkuje je i wskazuje, co zmienić.
Bad moderation costs more than fixing it.
Players leave after matches that feel bad, and every wrongly punished player is a paying customer with a grievance. A studio losing 3,000 players a year at €60 lifetime value writes off €180,000 — against a €48,000 validation that turns moderation into a measurable retention lever.
Zła moderacja kosztuje więcej niż jej naprawa.
Gracze odchodzą po rozgrywkach, które źle się kończą, a każdy niesłusznie ukarany gracz to płacący klient z pretensjami. Studio tracące 3 000 graczy rocznie przy wartości życiowej 60 € spisuje na straty 180 000 € — wobec walidacji za 48 000 €, która zamienia moderację w mierzalne narzędzie retencji.
Behavioural science, psychology, AI and engineering in one team.
Testing how AI behaves with people requires reading both sides. Most vendors understand the model or the psychology — validating the gap between them requires both.
Nauka o zachowaniu, psychologia, AI i inżynieria w jednym zespole.
Testowanie zachowania AI wobec ludzi wymaga rozumienia obu stron. Większość dostawców zna model albo psychologię — walidacja luki między nimi wymaga jednego i drugiego.
Behavioural science
Twenty years studying how people actually act in groups, under pressure, and online.
Psychology
Clinical and social psychology grounding, so emotional context gets read correctly rather than counted.
AI & machine learning
Hands-on model evaluation, prompt design, and statistical agreement testing against human raters.
Technology
Built and shipped behavioural analytics systems, not only written papers about them.
Conferences, clients and communities we have worked with
Nauka o zachowaniu
Dwadzieścia lat badań nad tym, jak ludzie zachowują się w grupie, pod presją i online.
Psychologia
Podstawy psychologii klinicznej i społecznej, dzięki którym kontekst emocjonalny jest rozumiany, a nie tylko liczony.
AI i uczenie maszynowe
Praktyczna ewaluacja modeli, projektowanie promptów i statystyczne testy zgodności z ludzkimi oceniającymi.
Technologia
Zbudowaliśmy i wdrożyliśmy systemy analityki behawioralnej, nie tylko napisaliśmy o nich artykuły.
Konferencje, klienci i społeczności, z którymi pracowaliśmy
Start with a free Community Health Check
Before any paid engagement, we will analyse your community and send you a behavioural report. No cost, no commitment — you see how we work before you spend anything.
Request the free reportZacznij od bezpłatnego Community Health Check
Przed jakimkolwiek płatnym projektem przeanalizujemy Twoją społeczność i przekażemy raport behawioralny. Bez kosztów i zobowiązań — najpierw zobacz, jak pracujemy.
Zamów bezpłatny raportTransparent, fixed prices. No "contact sales" wall.
Shown in EUR, USD or CAD. Comparable engagements elsewhere routinely cost two to five times more.
Przejrzyste, stałe ceny. Bez ukrywania cennika.
Podane w EUR, USD lub CAD. Porównywalne usługi kosztują zwykle od dwóch do pięciu razy więcej.
Behavioural Assessment
- One AI system, one context
- Controlled behavioural testing
- Comparison against human judgement
- Clear gap report with priorities
- Delivered in 3 weeks
Full Validation & Certificate
- Everything in the Assessment
- Ranked findings report
- Full revalidation after your changes
- Felixa Validate Certificate
- Evidence pack for clients & regulators
- Delivered in 6–8 weeks
Continuous Validation Partner
- Quarterly revalidation cycles
- Certificate kept current as models change
- Ongoing behaviour analytics
- Priority access to our team
- Annual agreement
Separate advisory track — not combined with certification
Founding clients, terms & invoicing
Founding clients. We are taking three founding clients at a substantially reduced rate, in exchange for permission to publish the findings as a named case study. Same method, same certificate, same independence rules.
Prices exclude VAT. Invoices are issued in EUR by FELIXA sp. z o.o., a company registered in Poland; USD and CAD figures are indicative and converted at the rate on the invoice date. EU business clients with a valid VAT number are invoiced under the reverse-charge mechanism. Multi-system and multi-context engagements are quoted individually — always fixed-price, always agreed before work begins. Advisory and certification are separate engagements: we do not issue a certificate for a system we advised on.
Ocena behawioralna
- Jeden system AI, jeden kontekst
- Kontrolowane testy behawioralne
- Porównanie z ludzkim osądem
- Czytelny raport luk z priorytetami
- Realizacja w 3 tygodnie
Pełna walidacja i certyfikat
- Wszystko z pakietu Ocena
- Raport z ustaleniami uporządkowanymi według wagi
- Pełna ponowna walidacja po Twoich zmianach
- Certyfikat Felixa Validate
- Pakiet dowodów dla klientów i regulatorów
- Realizacja w 6–8 tygodni
Stała walidacja partnerska
- Kwartalne cykle ponownej walidacji
- Certyfikat aktualny mimo zmian modeli
- Ciągła analityka behawioralna
- Priorytetowy dostęp do naszego zespołu
- Umowa roczna
Osobna ścieżka doradcza — nie łączona z certyfikacją
Klienci założycielscy, warunki i fakturowanie
Klienci założycielscy. Przyjmujemy trzech klientów założycielskich po znacznie obniżonej stawce, w zamian za zgodę na opublikowanie wyników jako studium przypadku z nazwą firmy. Ta sama metoda, ten sam certyfikat, te same zasady niezależności.
Ceny netto (bez VAT). Faktury wystawia w EUR spółka FELIXA sp. z o.o. zarejestrowana w Polsce; kwoty w USD i CAD mają charakter orientacyjny i są przeliczane po kursie z dnia wystawienia faktury. Klienci biznesowi z UE z ważnym numerem VAT UE rozliczani są w procedurze odwrotnego obciążenia. Projekty obejmujące wiele systemów lub kontekstów wyceniamy indywidualnie — zawsze w stałej cenie, ustalonej przed rozpoczęciem prac. Doradztwo i certyfikacja to osobne usługi: nie wydajemy certyfikatu dla systemu, przy którym doradzaliśmy.
Where AI behaviour really matters.
We work wherever AI interacts directly with people, decisions, or risk.
Tam, gdzie zachowanie AI naprawdę ma znaczenie.
Działamy wszędzie tam, gdzie AI wchodzi w bezpośrednią interakcję z ludźmi, decyzjami lub ryzykiem.
Trust & Safety
Defence
Risk
inteligencja
Bezpieczeństwo graczy
Obronność
przedsiębiorstwa
Ryzyko
Felixa Validate is the Behavioural Intelligence and validation layer that helps organizations understand, test, and improve how AI interacts with people.
Contact Felixa Validate play@felixagaming.comFelixa Validate to warstwa Behavioural Intelligence i walidacji, która pomaga organizacjom rozumieć, testować i doskonalić to, jak AI wchodzi w interakcje z ludźmi.
Skontaktuj się z Felixa Validate play@felixagaming.com