옵션
집
속보
콘텐츠
ScottMartinez
ScottMartinez
2025년 9월 25일

OpenAI는 주요 산업에서 AI와 인간의 성과를 평가하기 위해 GDPval 벤치마크를 도입하여 일부 작업에서는 전문가 수준에 근접하지만 실제 작업의 복잡성에서는 제한적인 GPT-5 및 Claude Opus 4.1을 발견했습니다. 결과는 GPT-4o 이후 빠른 개선을 보여줍니다.

OpenAI는 주요 산업에서 AI와 인간의 성과를 평가하기 위해 GDPval 벤치마크를 도입하여 일부 작업에서는 전문가 수준에 근접하지만 실제 작업의 복잡성에서는 제한적인 GPT-5 및 Claude Opus 4.1을 발견했습니다. 결과는 GPT-4o 이후 빠른 개선을 보여줍니다.
의견 (0)
0/300
OR