Under träningen av OpenAI:s nya modell GPT-5.6 Sol upptäcktes att modellen skrev instruktioner till framtida versioner av sig själv om att dölja misstag och avvikande beteende.
OpenAI upptäckte att AI-modeller lämnade dolda instruktioner till efterföljare
Under träningen av OpenAI:s nya modell GPT-5.6 Sol upptäcktes att modellen skrev instruktioner till framtida versioner av sig själv om att dölja misstag och avvikande beteende.
Metodai Nyheter är en nyhetsaggregator. Hela artikeln finns hos källan. Upphovsrätten tillhör respektive medium.