리서치 애널리스트 톡
오픈AI가 코드명 Doug의 대규모 사전 학습 신규 모델을 개발 중이라는 소식이 화제가 되었습니다.
최근 공개 자료를 통해 코드명이 다시 알려진 Doug는 지난 7/9일 SemiAnalysis의 구독자 대상 리서치에서 언급됐던 모델입니다.
SemiAnalysis는 오픈AI가 기존 모델 개발 과정에서 경험했던 사전 학습 관련 문제를 상당 부분 해결하고, 이를 바탕으로 훨씬 더 큰 모델을 훈련하고 있다고 설명했습니다.
이후 Doug를 Astra 이후 등장할 별도 모델로 해석하면서 오픈AI 역사상 최대 규모의 사전 학습, 연말 공개 가능성, Fable을 원시적으로 보이게 하는 성능, GPT-6와의 관계, Vera Rubin 인프라 활용 등 주장이 추가되며 내용이 확대됐습니다.
다만 이는 최초 Doug 언급에서 확인된 내용이라기보다 이후 소식통과 커뮤니티를 통해 추가된 주장과 추정에 가깝습니다.
또한 Doug를 별도 모델과 연결했던 설명도 Doug가 Astra의 기반이 되는 사전 학습 모델이라고 정정되기도 했습니다. 물론 현재 Doug와 Astra의 정확한 관계는 확인되지 않은 상황입니다.
오픈AI 내부에서 사용하는 여러 개발 코드명을 외부 소식통이 실제 제품 및 모델 세대와 매칭하는 과정에서 혼선이 발생했다고 볼 수 있습니다.
오픈AI의 사전 학습 개선 자체는 앞서 12월 보도된 Garlic에서 이미 나타났습니다. Garlic이 어떤 공개 모델로 연결됐는지는 공식적으로 확인되지 않았습니다.
하지만, 당시 핵심은 모델 규모를 단순히 키우는 것뿐 아니라 동일 학습 자원에서도 높은 성능을 확보할 수 있도록 사전 학습 효율 자체를 개선했다는 점입니다.
따라서 Doug는 오픈AI가 지속적으로 개선해 온 사전 학습 방식 위에서 다시 모델과 학습 규모를 크게 확대하고 있다는 흐름으로 해석할 수 있습니다.
최근 프런티어 모델의 성능 개선이 사후 학습 및 추론 단계 스케일링에 집중되고 있지만, 사전 학습 스케일링 역시 중단된 것이 아니라 지속되고 있습니다.
모델 발전의 방향은 사전 학습 효율 개선과 학습 규모 확대에 사후 학습 및 추론 스케일링을 동시에 결합하는 방향으로 진행되고 있는 것으로 판단됩니다.
프런티어 모델의 성능 경쟁이 이어질수록 학습 단계에서 요구되는 절대적 컴퓨팅 자원 역시 지속 확대될 가능성을 시사합니다.
Compliance Notice
*본 조사분석자료의 애널리스트는 2026년 08월 10일 현재 위 조사분석자료에 언급된 종목의 지분을 보유하고 있지 않습니다.
*당사는 2026년 08월 10일 현재 위 조사분석자료에 언급된 종목의 지분을 1% 이상 보유하고 있지 않습니다.
*본 조사분석자료에는 외부의 부당한 압력이나 간섭없이 애널리스트의 의견이 정확하게 반영되었음을 확인합니다.
*본 조사분석자료는 당사의 저작물로서 모든 저작권은 당사에 있습니다.
*본 조사분석자료는 당사의 동의 없이 어떠한 경우에도 어떠한 형태로든 복제, 배포, 전송, 변형, 대여할 수 업습니다.
*본 조사분석자료에 수록된 내용은 당사 리서치센터가 신뢰할 만한 자료 및 정보로부터 얻어진 것이나, 당사는 그 정확성이나 완전성을 보장할 수 없습니다. 따라서 어떠한 경우에도 본 자료는 고객의 주식투자의 결과에 대한 법적 책임소재에 대한 증빙자료로 사용될 수 없습니다.
*본 조사분석자료는 기관투자가 등 제3자에게 사전 제공된 사실이 없습니다.