한 줄 요약:
GPT-5.4는 추론, 코딩, 데스크톱 제어를 하나로 통합한 OpenAI의 최신 모델입니다. 대부분의 벤치마크에서 GPT-5.2를 능가하며, 100만 토큰 컨텍스트 창을 지원하고, 현재 GPT Proto와 같은 플랫폼에서 할인된 API 요금으로 이용할 수 있습니다.
GPT-5.4는 고급 추론, 코딩, 기본 제공 Computer Use를 하나로 결합한 OpenAI의 최신 AI 모델입니다. 새로운 기능, GPT-5.2와의 비교, 그리고 GPT Proto를 통해 저렴하게 이용하는 방법을 알아보세요.

GPT-5.4는 추론, 코딩, 데스크톱 제어를 하나로 통합한 OpenAI의 최신 모델입니다. 대부분의 벤치마크에서 GPT-5.2를 능가하며, 100만 토큰 컨텍스트 창을 지원하고, 현재 GPT Proto와 같은 플랫폼에서 할인된 API 요금으로 이용할 수 있습니다.
OpenAI는 가장 까다로운 작업을 위해 설계된 Pro 버전과 함께 지금까지 가장 강력한 모델인 GPT-5.4를 출시했습니다. 이 모델은 현재 ChatGPT의 Plus, Team, Pro 사용자와 API에서 이용할 수 있으며, 일상적인 전문 업무에서 AI의 의미 있는 도약을 보여줍니다. GPT-5.4는 네이티브 Computer Use를 포함한 최초의 OpenAI 범용 모델로, 단순히 텍스트를 생성하는 대신 실제 사용자처럼 데스크톱과 상호작용할 수 있습니다.

이 가이드에서 다루는 내용은 다음과 같습니다:
GPT-5.4가 실제로 무엇이며 GPT-5.2와 어떻게 다른지
글쓰기, 코딩, 추론 전반의 주요 성능 개선
새로운 Computer Use 및 시각적 이해 기능
GPT-5.4가 긴 문서와 대규모 코드베이스를 처리하는 방법
ChatGPT 및 API에서의 GPT-5.4와 GPT-5.4 Pro 가격
GPT Proto를 통해 GPT-5.4를 저렴하게 이용하는 방법
GPT-5.4는 이전 버전의 사소한 업데이트가 아닙니다. 이전에는 별도의 모델에 각각 있던 세 가지 기능, 즉 일반 추론, 코딩 능력, Computer Use를 하나로 통합했습니다. 이번 출시 전에는 세 가지가 모두 필요한 개발자가 서로 다른 특화 모델 간에 요청을 분산해야 했습니다. 이제 하나의 통합 옵션이 생겼습니다.
이 모델은 100만 토큰 컨텍스트 창을 지원하며, 단일 응답에서 최대 128,000토큰을 출력할 수 있습니다. 지식 기준일은 2025년 8월 31일입니다.
이전에는 이러한 기능들이 각각 별도의 도구나 모델 변형으로 제공되었습니다. GPT-5.4는 이를 하나의 API 엔드포인트로 통합했습니다:
일반 추론 및 글쓰기 — 문서 초안 작성, 분석, Q&A 포함
코드 생성 및 디버깅 — GPT-5.3-Codex의 강점을 계승
Computer Use — 스크린샷과 마우스/키보드 입력을 통한 데스크톱 환경 직접 제어
이러한 통합은 AI 기반 애플리케이션 구축을 훨씬 수월하게 만듭니다. 특히 GPT Proto와 같은 단일 통합 지점을 통해 유연하고 다목적 모델 액세스가 필요한 개발자에게 유용합니다.
| 벤치마크 | GPT-5.2 | GPT-5.4 | GPT-5.4 Pro |
| ARC-AGI-2 | 52.90% | 73.30% | 83.30% |
| GPQA Diamond | — | 92.80% | — |
| FrontierMath Tier 4 | 18.80% | 27.10% | 38.00% |
| Humanity's Last Exam (도구 미사용) | — | 39.80% | — |
| BrowseComp | 65.80% | 82.70% | 89.30% |
| OSWorld-Verified | 47.30% | 75.00% | — |
ARC-AGI-2는 모든 벤치마크 중 가장 큰 향상을 보였습니다. 표준 모델은 52.9%에서 73.3%로, Pro는 83.3%로 상승했습니다. 이 테스트는 추상 패턴 인식을 측정하며, 이는 역사적으로 언어 모델에게 어려운 영역이었습니다.
한 가지 주목할 만한 성능 하락: GPT-5.4는 HealthBench에서 GPT-5.2보다 약간 낮은 점수를 기록했습니다(62.6% vs 63.3%). OpenAI는 이를 축소하지 않고 시스템 카드에 공개했는데, 이는 주목할 만합니다.
GPT-5.4 Thinking은 현재 Plus, Team, Pro 구독자에게 순차적으로 제공되며 기본 모델로 GPT-5.2 Thinking을 대체할 예정입니다. GPT-5.2 Thinking은 2026년 6월 5일까지 Legacy 섹션에서 계속 사용할 수 있습니다. 무료 사용자는 자동 라우팅을 통해 GPT-5.4를 사용하게 될 수 있지만, 수동으로 선택할 수는 없습니다.
버전별 API 가격 비교는 다음과 같습니다:
| 모델 | 입력(토큰 100만 개당) | 출력(토큰 100만 개당) |
| gpt-5.2 | $1.75 | $14.00 |
| gpt-5.4 | $2.50 | $15.00 |
| gpt-5.2 Pro | $21.00 | $168.00 |
| gpt-5.4 Pro | $30.00 | $180.00 |
이 수치와 관련해 알아두어야 할 몇 가지 사항:
배치(Batch) 및 플렉스(Flex) 처리는 절반 가격으로 이용 가능
우선 처리는 표준 요금의 2배
단일 세션에서 272K 토큰을 초과하는 요청은 해당 세션 전체에 대해 입력 2배, 출력 1.5배 요율로 청구됩니다
지역 데이터 상주 처리는 10%가 추가됩니다
GPT-5.4 Pro는 표준 버전보다 12배 비쌉니다. 그렇지만 벤치마크에 따르면 두 버전은 각기 다른 강점을 가지고 있습니다. 실제로 표준 버전은 GDPval에서 근소하게 더 높은 점수(83.0% vs 82.0%)를 기록했으며, Pro 버전은 딥 웹 리서치와 복잡한 에이전트 작업에서 더 뛰어난 성능을 보여줍니다.
GPT-5.4는 GPT-5.3-Codex의 프로그래밍 강점을 이어받으면서, 길고 다단계로 진행되는 코딩 세션에서 작업에 집중하는 능력을 개선했습니다.
실제 GitHub 이슈를 기반으로 한 벤치마크인 SWE-Bench Pro에서 GPT-5.4는 57.7%를 기록해 GPT-5.2의 55.6%를 앞질렀습니다. 명령줄 작업을 테스트하는 Terminal-Bench 2.0에서는 GPT-5.4가 75.1%를 기록했습니다(GPT-5.3-Codex는 이 특정 테스트에서 77.3%로 약간 더 높은 점수를 기록했으며, 이는 주목할 만한 소폭 하락입니다).
Codex의 새로운 기능: /fast 모드는 기본 모델을 변경하지 않고 토큰 생성 속도를 최대 1.5배 높입니다. 또한 실험적인 Playwright Interactive 모드가 제공됩니다. 이 모드는 Codex가 웹 또는 데스크톱 앱을 작성하는 동안 실제 브라우저 창을 실행해 개발 중 실시간 시각적 테스트를 할 수 있게 해줍니다.
Codex나 Claude Code 같은 도구를 통해 GPT-5.4를 코딩 프로젝트에 사용하려면, GPT Proto가 직접 API 통합을 지원하며 OpenAI 공식 가격 대비 상당한 할인을 제공합니다.
OpenAI는 GDPval이라고 하는 내부 벤치마크에서 GPT-5.4를 테스트했습니다. GDPval은 미국의 9대 경제 분야, 44개 직무 범주에 걸쳐 실제 업무를 시뮬레이션하도록 설계되었습니다. 작업에는 스프레드시트 작성, 프레젠테이션 초안 작성, 일정 관리, 차트 만들기 등이 포함됩니다.

GPT-5.4는 GDPval에서 83.0%를 기록했습니다. GPT-5.2는 70.9%를 기록했습니다. 이는 전문가가 실제 업무에서 수행하는 작업을 그대로 반영하는 과제에서 12포인트 상승한 것입니다.
OpenAI는 사무 생산성 작업에 초점을 맞춘 추가 테스트도 진행했습니다:
투자은행 분석 업무를 반영하도록 설계된 스프레드시트 모델링 테스트에서 GPT-5.4는 87.3%를 기록해 GPT-5.2의 68.4%보다 19포인트 향상되었습니다.
블라인드 프레젠테이션 비교에서 인간 평가자는 68%의 비율로 GPT-5.4의 결과물을 선호했습니다. 더 나은 이미지 활용과 더 다양한 시각적 레이아웃이 이유로 꼽혔습니다.
이 모델과 함께 Excel용 ChatGPT 플러그인도 출시되었으며, Codex와 API에서 스프레드시트 및 프레젠테이션 생성을 위한 업데이트된 스킬 패키지도 제공됩니다.

GPT-5.4는 현재 OpenAI에서 가장 사실적으로 정확한 모델입니다. 실제 사용자가 오류가 있다고 신고한 프롬프트 세트를 사용해 테스트한 결과, OpenAI는 GPT-5.4가 GPT-5.2보다 개별적으로 틀린 주장을 33% 더 적게 생성하고, 오류가 하나 이상 포함된 전체 응답도 18% 더 적게 생성한다는 사실을 발견했습니다.
이번 릴리스에서 가장 큰 추가 기능 중 하나입니다. GPT-5.4는 스크린샷을 통해 모델이 실제 데스크톱 환경을 얼마나 잘 제어하는지 측정하는 벤치마크인 OSWorld-Verified에서 75.0%를 기록했습니다. 같은 테스트에서 인간 기준선은 72.4%입니다. GPT-5.4는 이 작업에서 인간 수준의 성능을 넘어섰습니다.

개발자는 이 기능을 두 가지 방식으로 사용할 수 있습니다:
스크린샷 기반 제어 — 모델이 스크린샷을 받아 인터페이스와 상호작용하기 위한 마우스 좌표와 키보드 명령을 출력합니다
코드를 통한 브라우저 자동화 — 모델이 Playwright 스크립트를 작성해 브라우저를 프로그래밍 방식으로 제어하며, 양식 작성, 데이터 입력, 웹 테스트에 유용합니다
이 기능은 기본 제공되는 computer 도구를 사용해 표준 API에서 바로 이용할 수 있습니다. 특별한 모델 라우팅이 필요하지 않습니다. 또한 모델이 중대한 영향을 미치는 작업을 수행하기 전에 사람의 승인을 요구하도록 확인 정책을 구성할 수 있습니다.
에이전트 워크플로나 자동화 도구를 구축하는 팀에게 GPT Proto와 같은 플랫폼은 경쟁력 있는 요금과 통합 API를 통해 GPT-5.4의 Computer Use 기능에 간편하게 액세스할 수 있는 방법을 제공합니다.
GPT-5.4는 대규모 도구 라이브러리를 처리하는 더 스마트한 방식을 도입했습니다. 이전에는 모든 API 호출에 사용 가능한 모든 도구의 전체 정의를 포함해야 했기 때문에, 구성된 도구가 많을수록 비용이 많이 들었습니다. 이제 모델은 검색 방식을 사용합니다. 사용 가능한 도구의 짧은 목록을 확인한 다음, 실제로 사용해야 하는 도구의 전체 정의를 가져옵니다.
이 변경만으로 MCP Atlas 벤치마크의 도구 사용량이 많은 작업에서 정확도 저하 없이 토큰 사용량이 47% 절감되었습니다. GPT-5.4는 해당 벤치마크에서 GPT-5.2의 60.6%에서 상승한 67.2%를 기록했습니다.
웹 리서치와 다중 페이지 정보 검색을 테스트하는 BrowseComp에서 GPT-5.4는 82.7%, Pro 버전은 89.3%를 기록해 둘 다 GPT-5.2의 65.8%를 크게 웃돌았습니다.
GPT-5.4의 웹 검색 및 리서치 기능은 GPT Proto의 웹 검색 인터페이스에서 직접 사용해 볼 수 있으며, 파일 기반 쿼리도 GPT Proto의 파일 분석 페이지에서 지원됩니다.
OpenAI의 직접 API 가격이 부담스럽게 느껴진다면, 특히 대규모 트래픽을 운영하거나 프로덕션 애플리케이션을 구축하는 팀이라면 GPT Proto AI API 플랫폼이 실용적인 대안이 될 수 있습니다. GPT Proto는 GPT-5.4를 포함한 최고 모델들을 할인된 요금으로 이용할 수 있게 모아 주는 통합 AI API 플랫폼입니다. 할인율은 일반적으로 GPT 모델 시장 가격보다 30~40% 낮습니다.

개발자는 모든 제공업체에 대해 별도의 API 키를 관리하는 대신 GPT Proto에 한 번 연결하고, 단일 표준화된 API 엔드포인트를 통해 GPT-5.4와 수백 개의 다른 모델에 액세스할 수 있습니다. 이 플랫폼은 지능형 라우팅과 자동 장애 조치를 사용하므로, 특정 제공업체에 장애가 발생해도 요청이 중단 없이 리디렉션됩니다.
GPT Proto는 GPT-5.4의 멀티모달 기능도 지원합니다. GPT Proto의 이미지-텍스트 변환 페이지에서 이미지-텍스트 처리를 살펴볼 수 있습니다. 이 기능은 문서 분석, 고해상도 스크린샷 처리, 시각적 이해가 중요한 Computer Use 워크플로에 특히 유용합니다.
이미 여러 AI 도구를 사용하고 있거나 현재 제공업체의 가격이나 안정성이 예측 불가능하다고 느끼는 개인과 팀에게 GPT Proto는 장기 계약이나 락인 없이 GPT-5.4를 기반으로 구축할 수 있는 안정적이고 비용 효율적인 방법을 제공합니다.
GPT-5.4는 OpenAI의 최신 모델로, GPT-5.2의 업그레이드 버전으로 출시되었습니다. 주요 차이점은 GPT-5.4에 네이티브 Computer Use 기능(스크린샷을 통해 데스크톱 소프트웨어를 제어하는 기능)이 포함되었고, 대부분의 전문 및 추론 벤치마크에서 더 높은 점수를 기록하며, 코딩, 추론, 시각적 제어를 각각 별도의 도구로 요구하지 않고 단일 모델로 통합한다는 점입니다.
이 기능을 사용하면 모델이 컴퓨터 화면의 스크린샷을 보고 마우스 클릭과 키보드 입력을 보내 소프트웨어와 상호작용할 수 있습니다. 웹 브라우저, 데스크톱 애플리케이션, 양식 기반 워크플로에서 작동합니다. 개발자는 별도의 특화 모델 없이 표준 API를 통해 이 기능을 사용할 수 있습니다.
표준 GPT-5.4 모델은 입력 토큰 100만 개당 $2.50, 출력 토큰 100만 개당 $15.00입니다. GPT-5.4 Pro는 입력 토큰 100만 개당 $30.00, 출력 토큰 100만 개당 $180.00로 상당히 비쌉니다. GPT Proto와 같은 플랫폼은 통합 API를 통해 GPT-5.4를 할인된 요금으로 이용할 수 있게 제공합니다.
GPT-5.4 Thinking은 ChatGPT Plus, Team, Pro 구독자가 사용할 수 있습니다. Enterprise 및 Education 사용자는 관리자가 활성화할 수 있습니다. 무료 사용자는 자동 라우팅을 통해 이 모델을 접할 수 있지만 수동으로 선택할 수는 없습니다. GPT-5.4 Pro는 Pro 및 Enterprise 계정으로 제한됩니다.
GPT-5.4는 특히 하나의 워크플로에서 추론, 코딩, 소프트웨어 상호작용이 모두 필요한 사람들에게 의미 있는 업그레이드입니다. OSWorld에서 Computer Use 기능이 인간 기준선을 넘어선 것은 실로 중요한 이정표입니다. 스프레드시트 작업, 코드 생성, 긴 컨텍스트 처리의 개선은 실용적이고 잘 문서화되어 있습니다.
가격은 GPT-5.2보다 높지만, 대부분의 전문 사용 사례에서는 성능 향상이 비용을 정당화합니다. 비용을 관리하면서 모델 액세스를 포기하고 싶지 않다면, GPT Proto가 GPT-5.4 생태계에 진입하는 더 저렴한 시작점으로서 검토할 가치가 있습니다.

소개 2026년 2월 26일, Google DeepMind는 조용히 Nano Banana 2를 출시했습니다 — 그리고 AI 커뮤니티는 즉시 이를 주목했습니다. 출시 후 몇 시간 만에 Arena 텍스트-이미지 리더보드 정상에 올랐으며, 1,279점으로 GPT-image-1과 Nano Banana Pro를 모두 앞섰습니다. 공식 기술명은 Gemini 3.1 Flash Image (Gemini 3.1 Flash Image Preview라고도 함)입니다. 대규모로 빠르고 고품질의 이미지 생성이 필요한 개발자, 디자이너, 콘텐츠 제작자에게 Nano Banana 2는 오랫동안 이어져 온 질문에 답합니다. Pro 수준의 속도 제한과 비용 없이 Pro 수준의 이미지 품질을 얻을 수 있을까요? 결과적으로 답은 그렇습니다.
Tiffany Layne | 2026-03-05

한 줄 요약 Seedance 2.0은 ByteDance의 강력한 신형 AI 비디오 모델로, 네이티브 오디오를 갖춘 시네마틱 클립을 생성합니다. 이 모델의 출시로 Disney와 다른 할리우드 스튜디오들은 저작권 우려를 이유로 중단 요구 서한을 보냈습니다. 개발자들은 오늘날 GPT Proto와 같은 플랫폼을 통해 이전 버전의 Seedance에 접근할 수 있으며, Seedance 2.0 API 지원은 곧 제공될 예정입니다.
Tiffany Layne | 2026-02-26

AI 비디오의 새로운 기준 ByteDance가 Seedance 2.0 출시와 함께 생성형 미디어의 지형을 공식적으로 재정의했습니다. 이 모델은 이전 모델들의 역량을 훨씬 뛰어넘어 시네마틱한 15초 클립, 네이티브 2K 해상도, 복잡한 멀티모달 입력을 지원하며 크리에이터와 개발자들이 이용을 위해 줄을 서게 만들었습니다. 복잡한 액션 장면을 스토리보드로 만들고 싶은 영화 제작자든, GPT Proto를 통해 강력한 Seedance 2.0 API 솔루션을 찾는 개발자든, 이 가이드는 업계의 새로운 강자에 대해 알아야 할 모든 것을 알려드립니다.
Tiffany Layne | 2026-02-25