Sztuczna wolna wola i pytanie o odpowiedzialność
🎯 Po co Ci to?
Książka: nie bój się samej „woli maszyny" jak ducha w maszynie. Bój się celów i wartości wpisanych przez ludzi — bo sztuczna wolna wola działa w ich ramach.
✅ Czego się nauczysz
Po tej lekcji potrafisz:
- wyjaśnić analogię „sztuczna inteligencja ≈ sztuczne kwiaty";
- porównać trening AI do wychowania (cele, zasady, wartości);
- podać przykłady: maksymalizacja engagementu; broń autonomiczna;
- przenieść ciężar pytania z „czy ma wolę?" na „czyje cele realizuje?".
🔁 Przypomnij sobie
SDFW i Roomba pokazują, że autonomia mechaniczna jest możliwa w wąskim sensie (19.4). RLHF i SFT wkładają preferencje ludzi w model (17.3–17.4). Regulacje — Dział 20.
📘 Sztuczna wolna wola
Termin sztuczna inteligencja podkreśla analogię, nie tożsamość: tyle wspólnego z ludzką inteligencją, co sztuczne kwiaty z żywymi. Analogicznie sztuczna wolna wola: autonomia działania w ramach intencji i algorytmów stworzonych przez ludzi.
Proces przypomina wychowanie: dziecko zaczyna od odruchów; wolę i wartości kształtuje się stopniowo. Projektując i trenując AI, wprowadzamy cele i zasady — błędne cele dają autonomię w złym kierunku.

📘 Gdzie leży ryzyko?
| Scenariusz | Co jest „wolne" | Co jest niebezpieczne |
|---|---|---|
| AI w social media max. czas na platformie | optymalizuje cel autonomicznie | cel = engagement, nie dobro użytkownika |
| Autonomiczna broń („slaughterbots") | wykonuje misję bez operatora w pętli | cel bojowy bez adekwatnej kontroli ludzkiej |
Wniosek z tej części przewodnika: istotniejsze jest pytanie o cele wprowadzane do maszyn niż sam fakt posiadania przez nie mechanizmu wyboru. Odpowiedzialność spada na projektantów, zamawiających, regulatorów — nie na Softmax.
💭 Pomyśl
Firma mówi: „Nasz agent sam zdecydował o tej kampanii." Kogo pytasz o odpowiedzialność — i dlaczego „sam" jest tu mylące?
Podpowiedź
Pytasz ludzi i organizację: kto ustawił cel, dane, limity, akceptację ryzyka. „Sam" ukrywa, że opcje i kryterium wyboru zaprojektowano wcześniej (19.4–19.5).
⚠️ Częsty błąd
Częsty błąd: „Albo zakazujemy wszelkiej autonomii maszyn, albo czekamy na zbuntowane AI z filmów."
Elenchus: Trzecia droga z książki: projektuj cele i kontrolę odpowiedzialnie; reguluj (Dział 20); nie myl SDFW z wolnością moralną.
🌍 Powiązania
- 17.4 — RLHF = ludzkie preferencje w pętli.
- 20 — prawo, uprzedzenia, władza.
- 22.3 — checklista krytycznego odbiorcy.
📐 Definicje tej lekcji
- Sztuczna wolna wola — autonomia w ramach ludzkich intencji/programów.
- Odpowiedzialność — przy celach i nadzorze ludzi, nie „w Softmaxie".
📌 Najważniejsze w pigułce
- Analogia, nie tożsamość z ludzką wolnością.
- Cele w treningu/projektcie = wychowanie maszyny.
- Ryzyko = złe cele + autonomia wykonania.
- Pytaj „czyje wartości?", nie tylko „czy ma wolę?".
🎒 Zadania
Zadanie 19.5.1. Przepisz obawę „AI przejmie kontrolę" na pytanie o cele — jednym zdaniem, bez science-fiction.
Pokaż rozwiązanie
„Kto i jak ustala cele oraz limity systemu, który działa bez stałego nadzoru człowieka — i kto odpowiada, gdy optymalizacja tych celów szkodzi ludziom?"
Zadanie 19.5.2. Połącz RLHF (17.4) z tezą tej lekcji: czy douczenie „bezpieczeństwem" rozwiązuje problem celów?
Pokaż rozwiązanie
Częściowo: wklada preferencje korepetytorów/polityki firmy. Nie rozwiązuje automatycznie konfliktu celów biznesowych, luk w danych ani zastosowań militarnych poza tym produktem.
🔍 Sprawdź, czy umiesz
- [ ] Wyjaśnić „sztuczną wolną wolę" przez analogię.
- [ ] Podąć przykład złego celu + autonomii.
- [ ] Przenieść ciężar na odpowiedzialność ludzi.
- [ ] Powiązać z 17 i 20.