무슨 일이 일어났나요?
Google은 Gemini 2.5가 출시된 지 불과 7개월 만인 2025년 11월 18일에 Gemini 3를 공식 출시했습니다. 새로운 모델은 Gemini 앱, Google AI Studio, Vertex AI 및 Google Antigravity라는 새로운 에이전트 개발 플랫폼을 통해 즉시 사용할 수 있게 되었습니다.
순다르 피차이(Sundar Pichai) CEO는 이를 “복잡한 추론을 위한 세계 최고의 모델”이라고 불렀으며, 벤치마크는 이러한 주장을 뒷받침합니다. Gemini 3는 획기적인 Elo 점수 1501점으로 LMArena 순위표 1위를 차지했습니다. 이는 1500점을 넘은 최초의 LLM입니다.
이는 약 1450 Elo를 맴돌던 Google의 이전 Gemini 2.5 Pro보다 약 50포인트 점프한 것이며, 인간 선호도 테스트에서 OpenAI의 GPT-5.1 및 Anthropic의 Claude 4.5 Sonnet보다 앞서 있습니다.
주요 세부정보
- 출시 날짜: 2025년 11월 18일
- LMArena Elo 점수: 1501(1500을 초과한 최초의 모델)
- 박사급 추론: 인류의 마지막 시험에서 37.5%, GPQA Diamond에서 91.9%
- 수학: MathArena Apex에서 23.4%(최신 기술)
- 코딩: WebDev Arena의 1487 Elo, SWE-bench에서 76.2% 검증됨
- 멀티모달: MMMU-Pro에서 81%, Video-MMMU에서 87.6%
- 가용성: Gemini 앱, AI Studio, Vertex AI, Google Antigravity
중요한 이유
소비자용
Gemini 3의 향상된 추론은 모델이 이제 지속적인 사람의 감독 없이 “10~15개의 일관된 논리적 단계를 안정적으로 완료”할 수 있음을 의미합니다. 이는 다단계 연구 프로젝트부터 복잡한 코딩 과제까지 분해하거나 수동 개입 없이 자율적으로 완료되는 더 복잡한 작업으로 해석됩니다.
이 모델은 또한 일반 텍스트 응답이 아닌 디지털 잡지와 유사한 형식으로 특정 답변을 제공하는 “생성 인터페이스”를 도입합니다. 이는 정보를 더 이해하기 쉽고 시각적으로 매력적으로 만듭니다.
업계용
2.5 출시 후 불과 7개월 만에 Gemini 3를 출시하는 Google의 빠른 반복은 AI 군비 경쟁이 심화되고 있음을 나타냅니다. 50포인트 Elo 점프는 중요합니다. 맥락상 Gemini 2.5와 대부분의 경쟁사 간의 격차는 일반적으로 20~30포인트였습니다.
OpenAI와 Anthropic은 이에 대응하여 출시 일정을 가속화할 가능성이 높습니다. 경쟁은 “누가 좋은 챗봇을 만들 수 있는가”에서 “누가 가장 유능한 자율 에이전트를 만들 수 있는가”로 바뀌고 있습니다.
개발자용
진정한 판도를 바꾸는 것은 Gemini 3와 함께 제공되는 새로운 에이전트 개발 플랫폼인 Google Antigravity일 수 있습니다. 기존 IDE와 달리 Antigravity는 AI 에이전트에게 “편집기, 터미널 및 브라우저에 대한 직접 액세스”를 제공하여 복잡한 소프트웨어 작업을 자율적으로 계획, 실행 및 검증할 수 있도록 합니다.
초기 리뷰에서는 이를 Cursor AI와 비교하며 일부 개발자는 이를 “커서 킬러”라고 부릅니다. 이제 macOS, Windows 및 Linux용 공개 미리 보기가 무료로 제공됩니다.
뒷이야기
Google은 변압기(GPT의 “T”)에 대한 선구적인 연구에도 불구하고 2022년 말 ChatGPT의 입소문 출시 이후 압박을 받아 왔습니다. 험난한 Bard 출시와 이후 Gemini로 브랜드 변경을 마친 후 Google은 따라잡기 위해 노력해 왔습니다.
2025년 4월에 출시된 Gemini 2.5는 격차를 상당 부분 해소했습니다. 그러나 OpenAI의 GPT-5.1과 Anthropic의 Claude 4.5 Sonnet은 모두 최근 몇 달 동안 강력한 모델을 출시하여 경쟁을 치열하게 유지했습니다.
Gemini 3는 단순히 따라잡는 것이 아니라 선도하고 있다는 Google의 선언인 것 같습니다.
전문가 반응
순다르 피차이(Google CEO):
피차이는 “제미니 3호는 광범위한 세계 지식과 심오한 추론을 결합한 가장 유능한 모델”이라고 말했다.
Constellation Research의 업계 분석가는 다음과 같이 언급했습니다.
“Gemini 3의 추론 기능과 Antigravity 플랫폼의 결합은 AI 시스템이 단순히 지원하는 것이 아니라 실행하는 ‘에이전트 우선’ 개발을 향한 Google의 전환을 의미합니다.”
다음은 무엇입니까?
Google은 AI Ultra 가입자를 위해 앞으로 몇 주 안에 “더 나은 추론 및 다중 모드 이해”를 갖춘 Gemini 3 Deep Think 모드를 발표했습니다. 가격은 공개되지 않았습니다.
이 모델은 이미 Gemini Enterprise 및 Vertex AI를 통해 기업 고객에게 제공됩니다. Gemini 앱을 통한 무료 등급 액세스가 이번 주에 전 세계적으로 출시됩니다.
타임라인:
- 현재: Gemini 앱, AI Studio, Vertex AI, Antigravity에서 Gemini 3 사용 가능
- 향후 몇 주: Ultra 가입자를 위한 Gemini 3 Deep Think 모드
- 알 수 없음: 개발자를 위한 API 가격(현재 미리 보기 상태)
분석
1501 Elo 점수는 인상적이지만 숫자는 실제 유틸리티로 변환되는 경우에만 중요합니다. 초기 실습 보고서에 따르면 Gemini 3는 특히 강력한 추론과 도구 사용(반중력을 통한)의 조합이 진정으로 차별화된 경험을 만들어내는 코딩 작업에서 뛰어난 성능을 발휘합니다.
주목할 만한 점은 속도이다. Gemini 2.5에서 Gemini 3까지 7개월은 공격적입니다. OpenAI와 Anthropic이 자신의 한계를 뛰어넘는 동안 Google이 이 속도를 유지할 수 있다면 업계에서는 2026년에 개척 모델이 대부분의 기업이 배포할 수 있는 것보다 더 빠르게 개선될 것으로 예상하고 있습니다.
와일드카드는 반중력입니다. 개발자 채택이 이루어지면 GitHub Copilot이 기능뿐만 아니라 워크플로 통합을 통해 OpenAI 모델에 혜택을 주는 방식과 유사하게 Gemini 주변에 해자를 만들 수 있습니다.
결론
Google Gemini 3는 단순한 증분 업데이트가 아닙니다. 이는 Google을 AI 경쟁의 선두에 다시 세우는 성명서입니다. 기록적인 벤치마크 점수, 복잡한 다단계 작업을 처리하는 향상된 추론, 개발자가 AI로 작업하는 방식을 재구성할 수 있는 새로운 코딩 플랫폼을 갖춘 Gemini 3는 “AI가 인간과 경쟁할 수 있는가”에서 “자율 AI 시스템을 중심으로 워크플로를 설계하는 방법”으로 대화를 전환합니다.
개발자라면 Antigravity를 즉시 테스트해볼 가치가 있습니다. AI 플랫폼을 평가하는 기업이라면 Gemini 3의 추론 기능과 다중 모드 성능이 새로운 모습을 보여줄 가치가 있습니다. 그리고 버클을 채우고 펼쳐지는 AI 전쟁을 지켜보고 있다면 2026년은 험난할 것입니다.
출처 (4)
- blog.google Gemini 3: Introducing the latest Gemini AI model from Google
- techcrunch.com Google launches Gemini 3 with new coding app and record benchmark scores
- cnbc.com Google announces Gemini 3 as battle with OpenAI intensifies
- blog.google Gemini 3 for developers: New reasoning, agentic capabilities
🦋 Bluesky 토론
Bluesky에서 토론하기