OpenAI, 속도를 줄이면서 경제적인 AI 작업을 위한 플렉스 프로세싱 도입

OpenAI, AI 모델을 위한 비용 절감형 Flex 프로세싱 도입
경쟁력 강화를 위한 전략적 움직임의 일환으로, OpenAI는 다양한 성능 특성을 제공하는 대신 가격을 대폭 낮춘 새로운 API 계층인 Flex 프로세싱을 공개했습니다. 이 접근 방식은 고객이 가변적인 리소스 가용성을 수용하여 비용을 최적화할 수 있는 클라우드 컴퓨팅 제공업체에서 사용하는 유사한 전략을 반영합니다.
플렉스 처리 세부 정보
새로운 옵션은 다음을 제공합니다:
- 모든 토큰 처리에서 50% 비용 절감
- 표준 처리와 비교하여 응답 시간 연장
- 잠재적인 간헐적 서비스 가용성
현재 모델에 대한 가격 비교:
모델 표준 입력 플렉스 입력 표준 출력 플렉스 출력 o3 10/M 토큰 5/M 토큰 40/M 토큰 20/M 토큰 o4-mini 1.10/M 토큰 0.55/M 토큰 4.40/M 토큰 2.20/M 토큰
대상 사용 사례
OpenAI는 Flex 처리를 다음과 같은 경우에 이상적이라고 생각합니다:
- 실험적 모델 테스트
- 대규모 데이터 처리
- 백그라운드 분석 작업
- 개발 환경 워크로드
확장된 검증 요건
Flex 출시와 동시에 OpenAI는 새로운 인증 조치를 시행했습니다:
- 티어 1~3 사용자에 대한 필수 ID 확인
- 고급 API 기능에 대한 액세스 제어
- 강화된 정책 시행 메커니즘
Flex 프로세싱의 도입은 Google을 비롯한 주요 제공업체들이 가격 대비 성능을 강조하는 Gemini 2.5 Flash와 같은 최적화된 모델을 출시하는 등 AI 분야의 경쟁이 치열한 시기에 이루어졌습니다. OpenAI의 이러한 움직임은 개발자들 사이에서 점점 더 커지는 비용 민감도를 해결하면서 시장 지위를 유지하기 위한 것으로 보입니다.
관련 기사
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
관련 특별 주제 추천
의견 (2)
0/500
このFlex処理、実はコスト面ではいいけどパフォーマンスが不安定なのって、ユーザーにとってどうなんだろう? 低優先タスクには確かに使えるけど、突発的な遅延が発生したら仕事に支障が出そう。OpenAIの競争力アップにはなるかもしれないが、使い手側のリスク管理がますます複雑になりそうでちょっと心配だな…🤔

OpenAI, AI 모델을 위한 비용 절감형 Flex 프로세싱 도입
경쟁력 강화를 위한 전략적 움직임의 일환으로, OpenAI는 다양한 성능 특성을 제공하는 대신 가격을 대폭 낮춘 새로운 API 계층인 Flex 프로세싱을 공개했습니다. 이 접근 방식은 고객이 가변적인 리소스 가용성을 수용하여 비용을 최적화할 수 있는 클라우드 컴퓨팅 제공업체에서 사용하는 유사한 전략을 반영합니다.
플렉스 처리 세부 정보
새로운 옵션은 다음을 제공합니다:
- 모든 토큰 처리에서 50% 비용 절감
- 표준 처리와 비교하여 응답 시간 연장
- 잠재적인 간헐적 서비스 가용성
현재 모델에 대한 가격 비교:
| 모델 | 표준 입력 | 플렉스 입력 | 표준 출력 | 플렉스 출력 |
|---|---|---|---|---|
| o3 | 10/M 토큰 | 5/M 토큰 | 40/M 토큰 | 20/M 토큰 |
| o4-mini | 1.10/M 토큰 | 0.55/M 토큰 | 4.40/M 토큰 | 2.20/M 토큰 |
대상 사용 사례
OpenAI는 Flex 처리를 다음과 같은 경우에 이상적이라고 생각합니다:
- 실험적 모델 테스트
- 대규모 데이터 처리
- 백그라운드 분석 작업
- 개발 환경 워크로드
확장된 검증 요건
Flex 출시와 동시에 OpenAI는 새로운 인증 조치를 시행했습니다:
- 티어 1~3 사용자에 대한 필수 ID 확인
- 고급 API 기능에 대한 액세스 제어
- 강화된 정책 시행 메커니즘
Flex 프로세싱의 도입은 Google을 비롯한 주요 제공업체들이 가격 대비 성능을 강조하는 Gemini 2.5 Flash와 같은 최적화된 모델을 출시하는 등 AI 분야의 경쟁이 치열한 시기에 이루어졌습니다. OpenAI의 이러한 움직임은 개발자들 사이에서 점점 더 커지는 비용 민감도를 해결하면서 시장 지위를 유지하기 위한 것으로 보입니다.
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
このFlex処理、実はコスト面ではいいけどパフォーマンスが不安定なのって、ユーザーにとってどうなんだろう? 低優先タスクには確かに使えるけど、突発的な遅延が発生したら仕事に支障が出そう。OpenAIの競争力アップにはなるかもしれないが、使い手側のリスク管理がますます複雑になりそうでちょっと心配だな…🤔





집






