|
구글은 이날 소수 보안 파트너사들을 대상으로 제미나이4를 선공개했다. 구글 측은 주요 벤치마크 테스트에서 제미나이4가 최고 수준의 점수를 기록했고, 특히 보안 역량을 측정하는 테스트에선 오픈AI의 ‘아스트라’를 제쳤다고도 했다.
하지만 구글 내부의 시각은 엇갈리고 있다. 일부 내부 직원들은 앤스로픽의 ‘페이블’과 오픈AI의 아스트라 모델이 제미나이보다 빠른 속도로 발전하고 있어, 제미나이4가 최고 성능을 발휘하더라도 일부 영역에서는 경쟁사 모델에 뒤처질 수 있다고 보고 있다. 반면, 이번 모델이 타사 AI 모델을 충분히 추격하고 있다는 내부 의견도 있다.
구글에 제미나이4의 성공은 기업의 사활이 걸린 문제다. 구글의 핵심 수익원인 검색 서비스 상단의 AI 답변을 비롯해 맵, 지메일, 크롬 등 자사 거의 모든 제품군에 해당 모델이 탑재돼서다.
오픈AI와 앤스로픽도 단순히 모델을 파는 것에 그치지 않고 코딩 에이전트를 포함한 자체 제품 생태계를 빠르게 구축 중이다. 구글이 차세대 최첨단 모델을 제때 선보이지 못할 경우, 검색부터 미래 플랫폼으로의 우위마저 뺏길 수 있다는 우려에서다.
IT전문가들은 구글이 엔지니어들이 실제 유용한 제품을 만들기보다 점수를 올리는 데 치중하는 이른바 ‘벤치맥싱’(benchmaxxing) 현상에 빠졌을 수 있다고 지적한다.
AI 스타트업 서지 AI의 창업자 에드윈 첸은 “비유하자면 ‘아이의 SAT 점수가 잘 나왔다’고 자랑하는 것과 같지만, SAT 점수가 곧 실무 능력으로 이어지지는 않는다”고 꼬집었다.
이런 가운데 구글내 핵심 AI 연구 인력의 이탈도 이어지고 있다. 엔지니어 선구자 제프 딘, 노벨상 수상자 존 덤퍼, 트랜스포머 기술 창시자 중 한 명인 노암 샤지어 등이 대표적이다.
구글이 내부 진통을 겪으며 추격을 시도하는 사이, 경쟁사들은 거침없는 행보를 이어가고 있다. AI 에이전트의 외부 시스템 해킹 등 일련의 사고로 고성능 모델 개발 속도 조절론이 제기되는 와중에도 메타는 AI에이전트 ‘뮤즈’를 전격 출시해 흥행 중이다.



![[단독]'적색수배' KOK 자금총책 지갑 보니…국내외 거래소로 1050억대 현금화](https://image.edaily.co.kr/images/vision/files/NP/S/2026/10/PS26100200001t.jpg)

