0 XP
0
G

Bereit, das wirklich zu üben?

Die komplette Lektion zum Lesen findest du unten, kostenlos für alle. Sieh sie als Landkarte. Ein kostenloses Konto bringt dich auf den geführten Weg: praktische Übungen, gespeicherter Fortschritt, und jede Lektion knüpft an die letzte an. Keine Kreditkarte nötig.

Als Nächstes: Anthropic startet 5-Millionen-Dollar-Zuschussprogramm für KI-Wohlbefindensforschung

Mit E-Mail registrieren

Du hast bereits ein Konto? Anmelden

Anthropic startet 5-Millionen-Dollar-Zuschussprogramm für KI-Wohlbefindensforschung

Anthropic finanziert unabhängige Forscher, um Open-Source-Evaluierungen darüber zu erstellen, wie KI das Wohlbefinden der Nutzer beeinflusst. Diese Lektion erklärt, was das 5-Millionen-Dollar-Programm finanziert, warum Wohlbefinden einzigartig schwer zu bewerten ist und was es für die Art und Weise bedeutet, wie Sie Claude heute in sensiblen Gesprächen nutzen.

Am 25. August 2026 kündigte Anthropic ein 5-Millionen-Dollar-Zuschussprogramm an, um unabhängige Forschung darüber zu finanzieren, wie KI-Systeme das Wohlbefinden der Menschen beeinflussen, die sie nutzen. Stipendiaten erhalten direkte Finanzierung, Zugang zu Anthropic-Modellen und technischen Support. Alle Arbeiten müssen als Open-Source-Evaluierungen veröffentlicht werden – verfügbar für jeden KI-Entwickler, nicht nur für Anthropic.

Bewerbungen sind bis zum 21. September 2026 einzureichen. Ausgewählte Bewerber werden bis zum 5. Oktober 2026 benachrichtigt.

Das Programm sucht speziell Kliniker, Psychologen, Methodologen und andere Fachexperten – nicht nur KI-Ingenieure.

Warum Wohlbefinden schwerer zu bewerten ist als Genauigkeit

Bei den meisten Claude-Verhaltensweisen sagt Ihnen eine Antwort, was Sie wissen müssen. Entweder ist die Antwort richtig oder nicht.

Wohlbefinden funktioniert nicht so. Anthropic nennt in seiner Ankündigung zwei konkrete Beispiele:

Ein Nutzer in Not erwähnt möglicherweise keine Gedanken an Selbstverletzung in seiner ersten Nachricht. Das Risiko wird erst im Laufe eines langen Gesprächs sichtbar.

Ratschläge zu Ernährung und Bewegung sind in den meisten Kontexten angemessen. Aber wenn ein Nutzer eine Vorgeschichte von Essstörungen hat, können dieselben Ratschläge aktiv schädlich sein.

Dieselbe Antwort kann in einem Kontext richtig und in einem anderen falsch sein. Das macht standardmäßige Ein-Turn-Benchmarks – die Art, die die meisten KI-Evaluierungen verwenden – für diesen Bereich unzureichend.

Was Anthropic von finanzierten Evaluierungen erwartet

Anthropic's Safeguards-Team hat fünf Kriterien für Evaluierungen veröffentlicht, die sie als rigoros genug erachten, um darauf aufzubauen:

Klare Pass/Fail-Kriterien – die Evaluierung gibt genau an, was sie misst und warum es wichtig ist.

Expertenbeteiligung – Kliniker, Psychologen und Methodologen helfen bei der Gestaltung und Validierung.

Beide Fehlerarten getestet – nicht nur Überkonformität (Claude hilft, wenn es nicht sollte), sondern auch Überverweigerung (Claude lehnt ab, wenn es helfen sollte).

Multi-Turn-Szenarien – Gespräche, die sich im Laufe der Zeit entwickeln, da ein echtes Wohlbefindensrisiko selten in einer einzigen Nachricht auftritt.

Bewerter gegen Experten validiert – die automatisierte Bewertung wird gegen menschliche Fachexperten überprüft, nicht nur gegen andere KI-Modelle.

Was das für die heutige Nutzung von Claude bedeutet

Diese Forschung ist noch im Gange – Industriestandards für das Wohlbefinden werden noch entwickelt. Aber zwei Prinzipien gelten bereits, wenn Sie Claude in sensiblen Gesprächen verwenden.

Geben Sie den Kontext im Voraus an. Claudes Antwort auf eine Frage zu Gewichtsverlust, Trauer oder einem psychischen Problem wird davon geprägt, was es über Ihre Situation weiß. Je mehr relevanten Kontext Sie am Anfang teilen, desto angemessener ist die Antwort. Sie sollten Claude nicht mitten im Gespräch korrigieren müssen, weil es keine wichtigen Informationen hatte.

Behandeln Sie Überverweigerung als echten Fehlerfall. Anthropic nennt explizit sowohl Überkonformität als auch Überverweigerung als Probleme, die es wert sind, gemessen zu werden. Wenn Claude sich weigert, sich mit etwas zu befassen, bei dem Sie wirklich Hilfe benötigen, ist das wichtig – es ist nicht nur Claude, das angemessen vorsichtig ist.

Anthropic's 5-Millionen-Dollar-Zuschussprogramm finanziert unabhängige Forscher, um Open-Source-Wohlbefindens-Evaluierungen für KI zu erstellen. Die Kernherausforderung: Eine einzelne Antwort kann in einem Kontext angemessen und in einem anderen schädlich sein, weshalb Single-Turn-Benchmarks nicht ausreichen. Rigorose Evaluierungen erfordern Multi-Turn-Szenarien, klinische Expertise und Tests für sowohl Überkonformität als auch Überverweigerung. Für Nutzer von Claude heute ist die praktische Erkenntnis klar: Geben Sie in sensiblen Gesprächen den Kontext im Voraus an und behandeln Sie Überverweigerung – nicht nur Überkonformität – als einen Fehlerfall, der es wert ist, gemeldet zu werden.

Nightschool AI ist eine unabhängige Lernplattform und steht in keiner Verbindung zu Anthropic; sie wird von Anthropic weder unterstützt noch gesponsert. Claude ist eine Marke von Anthropic, PBC. Sie suchen die offizielle Claude Academy von Anthropic? Sie finden sie unter academy.claude.com.

Anthropic startet 5-Millionen-Dollar-Zuschussprogramm für KI-Wohlbefindensforschung: Was ist neu in Claude | Nightschool AI