
Model GPT-5.6 Sol od OpenAI uzyskał 7,8 proc. na benchmarku ARC-AGI-3 i został pierwszym zweryfikowanym modelem frontierowym, który kiedykolwiek ukończył jedną z gier wchodzących w skład tego testu. Wyniki opublikowała 9 lipca fundacja ARC Prize, która prowadzi niezależną weryfikację najpotężniejszych systemów sztucznej inteligencji. Dotychczas żaden model nie przekraczał na tym benchmarku progu około 2 proc. […]








