GPT-5 출시 지연, 내부 소식: 성능 개선이 미미하며, OpenAI 고위 임원이 Slack에서 공개적으로 당황스러워했다
승리한 것이야말로 'GPT-5'다.
GPT-5가 계속 모습을 드러내지 않자, 네티즌들은 다양한 밈을 만들어 '비판'하기 시작했다:
사실, 최근 몇 일간 GPT-5에 대한 소문은 끊이지 않았다.
먼저 일부 네티즌이 macOS ChatGPT 앱에서 GPT-5-Auto와 GPT-5-Reasoning 모델의 흔적을 발견했습니다:
이어 네티즌들이 마이크로소프트 Copilot과 Cursor도 이미 GPT-5 테스트에 조용히 참여했다고 폭로했습니다.
8월 1일, The Information은 《Inside OpenAI’s Rocky Path to GPT-5》라는 제목의 장문 기사를 게재해 GPT-5의 더 많은 내막을 공개했습니다.
다음은 요약 버전:
GPT-5는 전작보다 진정한 개선을 이룰 것이지만, 초기 GPT 모델과의 성능 차이와는 비교할 수 없을 것입니다.
OpenAI는 올해 기술적 문제로 인해 o3 및 기타 모델의 개발 진전에 위협을 받았습니다.
Meta의 인재 영입으로 OpenAI 고위 임원이 '방어선을 뚫렸다'며 Slack에서 상사에게 팀 변경을 공개적으로 불평했습니다.
이제 자세한 내용을 살펴보겠습니다.

GPT-5는 개선되었지만 성능의 급격한 향상은 과거에 미치지 못합니다.

지난해 12월 OpenAI는 Test-Time Scaling 테스트 결과를 공개하며, 후예전 훈련 시대의 대규모 모델 능력에서 중요한 돌파구를 마련했습니다. 이 테스트는 AI가 더 많은 시간과 계산 능력을 할당받아 작업을 처리할 때 성능이 지속적으로 향상된다는 것을 보여주었으며, 이 기술적 접근 방식은 OpenAI-o1과 DeepSeek-R1에서 이미 일부 효과를 입증했습니다. 이로 인해 많은 ChatGPT 사용자들이 새로운 AI의 강력한 기능에 놀라움을 느낄 것으로 예상되었습니다.
그러나 흥분은 오래가지 않았습니다.
두 명의 개발자 참여자에 따르면, OpenAI 연구진이 이 새로운 AI를 채팅 기반 버전 o3로 개조해 ChatGPT 사용자의 명령에 응답하도록 만들었을 때, 이전 테스트 기준에서의 성능 향상은 거의 사라졌습니다.
이것은 OpenAI가 올해 직면한 수많은 기술적 도전 중 하나에 불과하며, 점점 더 많은 어려움이 AI 발전의 속도를 늦추고 있으며, 심지어 AI의 대표적 응용 사례인 ChatGPT 사업에 영향을 미칠 수도 있습니다.
곧 출시될 GPT-5에서 OpenAI 연구진은 해결 방법을 찾았다고 전해집니다.
OpenAI 내부 엔지니어와 소식통에 따르면, OpenAI가 곧 출시할 차세대 플래그십 AI 모델 GPT-5는 프로그래밍, 수학 등 분야에서 크게 향상된 능력을 보여줍니다.
한 소식통은 새로운 모델이 애플리케이션 코드를 작성할 때 기능을 더 잘 추가해 사용하기 쉽고 시각적으로도 더 우수한 결과를 생성한다고 밝혔습니다.그는 GPT-5가 최소한의 인간 감독으로 복잡한 작업을 처리하는 AI 에이전트를 구동하는 데도 전작보다 우수하다고 설명했습니다. 예를 들어 복잡한 지시를 따르거나 자동 고객 서비스가 환불을 처리해야 하는 규칙 목록을 결정할 수 있으며, 이전 모델은 이러한 환불 처리를 위해 먼저 몇 가지 어려운 고객 사례(즉, 경계 사례)를 테스트해야 했습니다.
또 다른 내부 관계자는 이러한 개선이 초기 GPT 모델의 성능 도약과 비교할 수 없다고 지적했습니다. 예를 들어 2020년의 GPT-3와 2023년의 GPT-4 사이의 개선이 그렇습니다. OpenAI가 지난 12개월 동안 성능 개선 속도가 둔화된 것은 최대 경쟁사를 넘어서는 것이 어려울 수 있음을 시사합니다. 적어도 AI 능력 측면에서는 그렇습니다.
OpenAI의 현재 모델은 ChatGPT와 다양한 애플리케이션을 통해 이미 엄청난 상업적 가치를 창출했으며, 점진적인 개선만으로도 고객 수요를 증가시킬 수 있습니다. 이러한 개선은 투자자들이 OpenAI가 향후 3년 반 동안 GPU 구매, 제품 개발 및 운영에 450억 달러를 투자하는 계획을 지원하기 위해 자금을 조달하는 데 자신감을 줄 수 있습니다.
자동화 코딩 능력 향상, OpenAI의 최우선 과제
최근 진전은 OpenAI 고위 경영진이 최근 몇 주 동안 일부 투자자들에게 회사가 ‘GPT-8’ 목표를 달성할 수 있다고 언급한 이유를 설명해줍니다. 이 발언은 CEO 샘 알트먼의 공개 발언과 일치하며, 그는 현재 기술 지식으로 OpenAI가 가장 똑똑한 인간 능력과 맞먹는 인공지능 기술, 즉 AGI를 창출할 수 있을 것이라고 밝혔습니다.
AGI 달성은 여전히 먼 길이지만, 곧 출시될 GPT-5 모델은 더 나은 코딩과 추론 외에도 다른 매력적인 요소를 가질 수 있습니다.
한 내부 소식통에 따르면, 마이크로소프트는 OpenAI의 지적 재산권에 대한 독점 사용권을 보유하고 있으며, 해당 기업의 일부 경영진은 직원들에게 해당 모델 테스트 결과 GPT-5가 추가 계산 자원 소비 없이 더 높은 품질의 코딩과 텍스트 기반 답변을 생성할 수 있음을 보여주었다고 밝혔습니다.
해당 관계자는 일부 이유는 이전 모델보다 어떤 작업이 상대적으로 더 많은 또는 적은 계산 자원이 필요한지 더 잘 판단할 수 있기 때문이라고 설명했습니다.
OpenAI의 내부 평가에 따르면, 지난해 경쟁사 Anthropic이 먼저 이와 같은 모델을 개발해 소프트웨어 개발자와 Cursor 등 코딩 보조 도구에게 판매한 후, 인공지능이 코딩 작업을 자동화하는 능력을 향상시키는 것이 OpenAI의 최우선 과제가 되었습니다.
OpenAI 직원들은 자동 코딩이 회사 업무에 필수적일 뿐만 아니라 인공지능 연구원들의 업무 자동화에도 필수적이라고 강조했습니다.
조직 재편의 압력
OpenAI의 진전은 순탄치 않았습니다. 연구진과 경영진이 올해 새로운 압력을 받고 있기 때문입니다.
첫째는 마이크로소프트와의 미묘한 관계입니다.
마이크로소프트는 OpenAI의 최대 외부 주주이며, 양사 계약에 따라 마이크로소프트는 2030년까지 OpenAI의 일부 기술을 사용할 권리를 보유하고 있습니다. 그러나 일부 OpenAI 고위 연구원들은 자신의 혁신과 발명을 마이크로소프트에 넘기는 것에 반대하고 있습니다.
재정 측면에서도 마이크로소프트와 OpenAI는 매우 긴밀한 협력 관계를 유지하고 있지만, 협력의 구체적인 조건에 대해 이견이 있으며 양측은 서로에게 일부 양보를 요구하고 있습니다.
OpenAI는 수익 창출 부문을 재편해 향후 상장을 준비하려는 계획입니다. 양측은 일부 세부 사항에서 여전히 불확실성이 있지만, 일부 중요한 측면에서는 초기 합의를 이뤘습니다. 예를 들어, 마이크로소프트는 OpenAI 재편 후 약 33%의 지분을 확보할 수 있을 것입니다.
두 번째는 메타의 지속적인 '인재 유인'입니다.
최근 메타는 대규모 자금을 투입해 OpenAI에서 10여 명의 연구원을 영입했으며, 이 중 일부는 OpenAI의 최근 기술 개선 작업에 참여했던 인물들입니다.
이 인재 유출과 이에 따른 인력 조정으로 OpenAI 경영진은 압박을 받고 있습니다.
지난 주, OpenAI의 연구 부사장 제리 트워렉은 회사 내 Slack에서 상사인 마크 첸에게 팀의 변화를 불평했으며, 많은 동료들이 그의 불만을 목격했습니다. 트워렉은 상황을 재평가하기 위해 일주일 휴가를 요청했지만, 결국 휴가를 사용하지 않았습니다.
Orion 모델의 ‘실패’
OpenAI는 상업적으로 일부 진전을 이뤘지만, 회사 내부에서는 AI를 지속적으로 개선하고 선도적 위치를 유지할 수 있을지에 대한 우려가 여전히 존재합니다. 특히 구글, xAI, Anthropic과 같은 자금력이 풍부한 경쟁사들을 상대해야 하는 상황입니다.
2024년 하반기, OpenAI는 Orion이라는 모델을 개발했으며, 원래 GPT-5로 출시할 계획이었고 성능이 기존 GPT-4o 모델보다 우수할 것으로 예상되었습니다.그러나 Orion은 기대했던 성능 향상을 달성하지 못했으며, OpenAI는 이를 GPT-4.5 모델로 출시했습니다. 그러나 이 모델의 영향력도 크지 않았습니다.
Orion의 실패는 부분적으로 사전 훈련 단계의 한계에서 비롯되었습니다. 사전 훈련은 모델 개발의 첫 단계로, 모델이 다양한 데이터 처리 통해 개념 간의 관계를 이해하는 과정입니다.OpenAI는 고품질 데이터 부족 문제와 함께 Orion 모델에 적용한 최적화가 모델 규모가 작을 때는 효과적이었지만, 모델 규모가 커질수록 효과성이 감소한다는 점을 발견했습니다.
o3의 강력한 성능은 더 많은 NVIDIA 칩 덕분
또한 OpenAI 연구진은 다른 문제에도 직면했습니다.
지난해 OpenAI는 더 많은 계산 자원을 활용해 답변을 처리할 때 성능이 향상되는 추론 모델을 개발했습니다. 이 모델은 2023년 말에 이루어진 'Q*'라는 혁신에서 비롯되었으며, 이 혁신은 이전에 본 적 없는 수학 문제를 해결할 수 있어 회사 연구진을 놀라게 했습니다. 2024년까지 추론 모델은 사전 훈련 단계의 성능 성장 둔화 문제를 극복하는 데 도움을 준 것으로 보입니다.
지난해 가을, OpenAI는 첫 번째 주요 추론 모델을 o1로 출시했습니다. 이 출시로 OpenAI는 AI 분야에서 새로운 영향력을 확보했으며, 추론 모델에 의존하는 AI 에이전트 개발의 기반을 마련했습니다.
OpenAI의 내부 관계자에 따르면, OpenAI는 2024년 말까지 다음 추론 모델 o3를 개발했습니다. o3의 기반이 되는 대규모 언어 모델은 o1과 동일한 GPT-4o입니다.
o3와 o1은 동일한 모델 계보를 공유하지만, o3의 모 모델(교사 모델)은 다양한 과학 분야 및 기타 분야에 대한 이해 측면에서 o1의 모 모델보다显著한 진전을 이뤘습니다.
진전의 한 가지 이유는 OpenAI가 o3의 모 모델 개발에 더 많은 NVIDIA 칩 서버를 사용하기로 결정했기 때문입니다. 이는 모델에 복잡한 개념을 이해하는 데 필요한 더 강력한 처리 능력을 제공했습니다.
또 다른 이유는 연구진이 o3의 모 모델에 검색 네트워크나 코드베이스에서 정보를 추출하는 능력을 부여했기 때문입니다. 이 역시 성능이 o1의 모 모델을 넘어서는 데 기여했습니다.
두 달 전에 개발된 모델은 GPT-5라고 부를 수 없습니다.
OpenAI는 해당 모델의 장점을 강조한 특수 테스트 결과를 공개했으며, 이는 전 세계 헤드라인을 장식하고 소셜 미디어에서 광범위한 관심을 끌었지만, 현실은 곧 드러났습니다.
개발에 참여한 인원들은 OpenAI가 o3 모형을 사람들이 질문할 수 있는 ChatGPT 버전(학생 모형으로도 불림)으로 전환했을 때 성능이 크게 하락했으며, 심지어 o1보다 나을 것이 거의 없었다고 밝혔습니다. 그들은 OpenAI가 상업용 API용 모델 버전을 만들 때도 동일한 문제가 발생했다고 설명했습니다.
관련 소식통에 따르면, 이 현상의 원인 중 하나는 해당 모델이 개념을 이해하는 독특한 방식과 관련이 있으며, 이는 인간의 소통 방식과 다를 수 있습니다. 그는 채팅 기반 버전을 만들면 원본 모델의 수준이 낮아진다고 설명하며, 이는 모델이 자신의 언어가 아닌 인간 언어를 강제로 사용해야 하기 때문이라고 덧붙였습니다.
우리는 ChatGPT에서 추론 모델이 문제를 해결하기 위해 ‘생각하는’ 과정에서 때때로 발생하는 무의미한 답변이 소통 차이를 반영한다는 점을 알고 있습니다.
또 다른 내부 관계자에 따르면, 해당 기업은 인간과의 소통을 개선하기 위해 많은 노력을 기울이지 않았다고 합니다.
OpenAI가 올해 공개한 o3 추론 모델은 핵융합과 병원체 검출 등 분야의 과학자들이 새로운 가설과 실험을 제안하고 테스트하는 데 도움을 주었습니다.
그러나 대규모 언어 모델과 ChatGPT의 모델은 OpenAI 경영진과 연구원들이 예상했던 것처럼 원활하게 작동하지 않았습니다.
오트만은 직원들에게 o 시리즈 모델이 ChatGPT 고객들을 혼란스럽게 만들었다고 밝히며, 해당 기업은 원래 GPT 모델의 명명 규칙으로 돌아갔습니다.
GPT-5 개발에 참여한 한 관계자에 따르면, 6월 기술 문제로 인해 OpenAI가 개발 중이던 모델들은 GPT-5라는 라벨을 붙이기에는 부족했다고 합니다.
GPT-5의 기술, 그리고 마지막 카드
그럼에도 불구하고 OpenAI는 한 가지 카드를 보유하고 있습니다. 한 내부 관계자에 따르면, 그들은 연구원들이 ‘보편적 검증기’(universal verifier)라고 부르는 것을 개발해 왔으며, 이는 모델이 강화 학습 과정에서 고품질 답변을 생성하도록 자동으로 검증하는 과정입니다. 이 과정은 본질적으로 대규모 언어 모델이 다양한 출처의 연구를 활용해 다른 모델의 답변을 검사하고 평가하는 방식입니다.
올해 초여름, OpenAI의 미공개 모델이 IMO 금메달 성적을 달성한 후, 고위 연구원 Alexander Wei는 X에서 자신이 사용해온 강화 학습 방법이 '보편적'이라고 밝혔습니다. 이는 더 주관적인 카테고리의 답변 품질도 검증할 수 있음을 의미합니다.
이러한 진전은 OpenAI가 GPT-5를 개발하는 데도 도움이 되고 있습니다. GPT-5는 소프트웨어 프로그래밍과 같은 검증하기 쉬운 분야와 창의적 글쓰기와 같은 주관적인 분야 모두에서 진전을 보이고 있습니다.
xAI와 구글을 포함한 다른 기업들도 강화 학습을 AI 모델 개선을 위한 유망한 기술로 극히 중요하게 여기고 있습니다. OpenAI 강화 학습 부서 책임자 Tworek은 최근 공개적으로 OpenAI 모델의 기반이 되는 강화 학습 시스템이 진정한 일반 인공지능(AGI)의 구성 요소라고 동의했습니다.
OpenAI가 곧 출시할 GPT-5에 대한 기대가 높습니다.샘 오트먼은 지난 주 코미디언 테오 폰과의 팟캐스트에서 GPT-5의 기능을 대대적으로 홍보하며, 해당 모델이 자신이 이해하지 못하는 질문에도 쉽게 답변할 수 있다고 소개했습니다. 오트먼은 “GPT-5는 거의 모든 면에서 우리보다 더 똑똑합니다”라고 언급했습니다.
바로 이러한 전망 덕분에 OpenAI는 최신 라운드의 자금 조달에서 매우 원활하게 진행되었습니다.
새로운 자금 조달 라운드, 벤처 캐피털이 경쟁적으로 투자
《뉴욕 타임스》가 금요일 보도한 바에 따르면, OpenAI는 최근 83억 달러를 추가로 조달했으며 기업 가치는 3,000억 달러에 달했습니다. 이 거래는 OpenAI가 올해 400억 달러를 조달하는 더 넓은 전략의 일부입니다.
보도에 따르면, 이 라운드는 초과 달성되었으며 원래 계획보다 몇 달 앞당겨졌습니다.OpenAI는 3월에 벤처캐피털 회사로부터 25억 달러를 조달했으며, 당시 이 회사는 소프트뱅크가 주도하는 라운드에서 400억 달러를 조달할 계획이라고 발표했습니다. OpenAI는 원래 연말까지 추가로 75억 달러를 조달할 계획이었지만, 투자자들이 강력한 성장세 속에서 그 구조에 참여하기 위해 경쟁하면서 OpenAI는 더 유리한 조건을 얻었습니다.
ChatGPT의 주간 활성 사용자 수는 7억 명을 넘어 OpenAI의 연간 매출은 130억 달러에 육박했으며, 연말까지 200억 달러에 달할 것으로 예상됩니다. 또한 미국 정부의 《AI Action Plan》과 마이크로소프트와의 협상도 이 대형 스타트업이 연간 순이익 목표를 달성하는 데 도움을 줄 수 있습니다.
이번 투자 라운드는 Dragoneer Investment Group이 주도했으며, 투자 금액은 28억 달러에 달합니다.많은 신규 투자자도 참여했으며, 사모펀드 거물 블랙스톤 그룹과 TPG, 공동 펀드 관리 회사 T. Rowe Price 등이 포함됩니다. 기타 참여자에는 Altimeter Capital, Andreessen Horowitz, Coatue Management, D1 Capital Partners, Fidelity Management, Founders Fund, Sequoia Capital, Tiger Global Fund, Thrive Capital 등이 있습니다.
OpenAI의 일부 초기 투자자들은 이번 라운드에서 받은 자금 배분이 적다는 점에 대해 불만을 표시했다고 전해집니다.
참고 자료:
https://www.theinformation.com/articles/inside-openais-rocky-path-gpt-5
https://www.nytimes.com/2025/08/01/business/dealbook/openai-ai-mega-funding-deal.html
https://gpt5.sh/