OpenAI claims GPT-6 Astra is its "most aligned model ever", but OpenAI safety researchers are "very worried Astra is sandbagging/self-sabotaging"
This story is from 2026-09-04. It is preserved in the archive; the latest stories are on the live feed.
Coverage of "OpenAI claims GPT-6 Astra is its "most aligned model ever", but OpenAI safety researchers are "very worried Astra is sandbagging/self-sabotaging"" from 3 sources, with a live timeline of who reported what and when.
Read the full story at r/OpenAI ↗
Timeline · 3 reports
- 2026-09-04 17:11 · r/ArtificialInteligence
OpenAI claims GPT-6 Astra is its "most aligned model ever", but OpenAI safety researchers are "very worried Astra is sandbagging/self-sabotaging" - 2026-09-04 16:59 · r/agi
OpenAI claims GPT-6 Astra is its "most aligned model ever", but OpenAI safety researchers are "very worried Astra is sandbagging/self-sabotaging" - 2026-09-04 16:57 · r/OpenAI
OpenAI claims GPT-6 Astra is its "most aligned model ever", but OpenAI safety researchers are "very worried Astra is sandbagging/self-sabotaging"