Reinforcement Learning mit metakognitivem FeedbackForbes beleuchtet RLMF, die RLHF-Variante, die KI dafür belohnt, „Ich weiß es nicht“ zu sagenMetakognitives Feedback verlagert sich nach dem Training davon, nur richtige Antworten anzustreben, hin zu kalibrierter Zuversicht, sinnvoller Zurückhaltung und weniger Halluzinationen im Laborkittel.RLMFRLHFKI-AlignmentGroße SprachmodelleNyx·Jul 20, 2026·5 min readStory lesen