Amazon macht Mechanical Turk für Neukunden dicht
Amazon schließt Mechanical Turk ab Ende Juli für neue Kunden. Agenten-Teams brauchen damit robustere Review- und Evaluations-Workflows.
Amazon kündigte im Juli an, Mechanical Turk ab dem 30. Juli 2026 für neue Kunden zu schließen. Bestehende Nutzer sollten nach dem Hinweis auf der MTurk-Website weiter Zugriff behalten. Für neue Projekte ist damit eine Annahme hinfällig: menschliche Prüfarbeit lässt sich nicht mehr einfach als offener Marktplatz-Baustein einplanen.
Wer Human-in-the-loop bisher kurzfristig einkaufen wollte, braucht einen belastbaren Alternativweg. Das betrifft Agenten-Evaluationen ebenso wie manuelle Freigaben und Datenprüfungen.
Was Amazon damals angekündigt hat
Auf der MTurk-Startseite formulierte Amazon: „Amazon Mechanical Turk will be closed to new customers, effective July 30, 2026. Existing users will not be impacted by this change.“ Die Mitteilung unterscheidet damit klar zwischen dem Zugang für neue Kunden und bestehenden Accounts.
Mechanical Turk war über Jahre ein verbreiteter Weg, um menschliche Arbeit in digitale Abläufe einzubauen: Daten prüfen, Texte gegenlesen, Umfragen ausspielen, Inhalte moderieren oder Labels erzeugen. Gerade frühe KI- und Datenprojekte konnten so kurzfristig viele menschliche Urteile einholen, ohne eine eigene Review-Struktur aufzubauen.
Die Ankündigung verändert diesen Ausgangspunkt. Neue Vorhaben sollten nicht darauf bauen, dass sich ein allgemeiner MTurk-Zugang spontan als Review-Backstop dazubuchen lässt.
Amazon verweist auf spezialisiertere Wege
Auf derselben Seite verwies Amazon auf SageMaker Ground Truth und Ground Truth Plus. Nach Amazons Beschreibung unterstützt Ground Truth beim Aufbau eigener Labeling-Workflows und Workforce-Setups; Ground Truth Plus ist ein verwalteter Dienst mit Experten-Workforce. MTurk sollte über diese Angebote weiter erreichbar sein.
Darin liegt die strategische Verschiebung hinter der Meldung. Menschliche Datenarbeit wird stärker als Teil eines ML-Stacks mit definierten Prozessen und Workforce-Modellen gerahmt. Eine schnelle Einzelaufgabe und eine verlässliche Prüfung stellen unterschiedliche Anforderungen.
Bei Agenten zeigt sich das besonders deutlich. Es geht selten um ein einzelnes Label. Ein Reviewer muss oft Tool-Auswahl, Kontext, ausgelöste Aktion und Ergebnis zusammen bewerten. Dafür reichen eine Ja/Nein-Frage und ein anonymer Klickmarkt häufig nicht aus.
Was neue Projekte einplanen sollten
Wer menschliche Kontrolle für Agenten-Antworten, Tool-Aufrufe oder Datenbereinigung einkaufen will, sollte die benötigte Prüfart zuerst genau beschreiben. Eine schnelle Kontrolle hilft wenig, wenn die eigentliche Frage lautet, ob ein Agent ein Risiko übersehen oder einen Prozessschritt falsch interpretiert hat.
Bei produktiven Workflows wird Review zum Teil des Betriebsmodells. Sobald Agenten E-Mails sortieren, Deployments anstoßen oder mit Kundendaten arbeiten, braucht es nachvollziehbare Testfälle, klare Rubriken und Eskalationspfade. Viele Bearbeiter allein ergeben noch keine verlässliche Kontrolle.
Auch die Fehlerdiagnose verlangt mehr als breite Klickarbeit. Ein Team muss unterscheiden können, ob ein Fehler im Modell, im Tool, im Prompt oder im Ablauf entstanden ist. Fachlich passende Reviewer oder interne Prüfpfade kosten mehr, liefern aber oft die bessere Diagnose.
Die eigentliche Lehre für Agenten-Teams
Die Amazon-Mitteilung ist ein Marker für einen reiferen Umgang mit menschlicher Kontrolle. Agenten scheitern in der Praxis häufig an Übergängen: Wer prüft Unsicherheit? Wer stoppt riskante Aktionen? Wer entscheidet, ob ein formal erfolgreiches Tool-Ergebnis fachlich korrekt ist?
Für mich folgt daraus eine einfache Regel: Menschliche Kontrolle muss am realen Risiko geplant werden. Sie braucht benannte Rollen, Prüfkriterien und einen klaren Eskalationsweg. Review gehört als Sicherheitsfunktion in das eigene System, nicht als Restarbeit ans Ende.
Transparenz
agentenlog.de nutzt KI-Assistenz für Recherche, Struktur und Entwurf. Inhaltliche Auswahl, Einordnung und Veröffentlichung liegen redaktionell bei agentenlog.de; Quellen und Fakten werden vor Veröffentlichung automatisiert geprüft.
Quellen
- https://www.mturk.com/
- https://docs.aws.amazon.com/general/latest/gr/maintenance_services.html
- https://techcrunch.com/2026/07/05/amazon-will-stop-accepting-new-customers-for-mechanical-turk/
- https://siliconangle.com/2026/07/05/amazons-mechanical-turk-service-now-life-support-stops-accepting-new-users/
Das könnte dich auch interessieren
Anthropic erhält 5 Milliarden von Amazon – verpflichtet sich zu 100 Milliarden Cloud-Ausgaben
Amazon investiert 5 Milliarden Dollar in Anthropic. Dafür verpflichtet sich Anthropic zu mehr als 100 Milliarden Dollar AWS-Ausgaben in den nächsten 10 Jahren.
LangGraph gibt Agenten einen kontrollierten Fehlerpfad
LangGraph verbindet Wiederholungen, Zeitlimits und Fehlerbehandler im Ablaufgraphen zu einem kontrollierten Fehlerpfad für Agenten.
GLM-5.3: Offene Gewichte treffen auf 755 Gigabyte Realität
Z.ai veröffentlicht GLM-5.3 mit 753 Milliarden Parametern. Schon der FP8-Checkpoint verlangt jedoch Datacenter-Infrastruktur.