구글·메타 경쟁 AI 모델 동시 공개…승자는?

BeInCrypto
BeInCrypto에서 열기
구글·메타 경쟁 AI 모델 동시 공개…승자는?

구글과 메타는 수요일 불과 몇 시간 차이로 최신 프론티어 AI 모델을 출시했습니다. 구글은 제미니 3.8 플래시와 함께 사이버보안 변형 모델을 공개했으며, 메타는 뮤즈 스파크 1.3을 내놓았습니다.

두 모델의 동시 출시는 직접적인 비교를 불러일으킵니다. 인공지능 분석업체 아티피셜 애널리시스의 독립 테스트 결과는 엇갈립니다. 메타는 에이전트형 지식 작업과 과학적 추론에서 앞서며, 구글은 사실 회상력과 터미널 코딩에서 우위를 보입니다.

두 프론티어 모델이 같은 날 출시되었습니다

제미니 3.8 플래시는 구글의 여섯 주 만에 세 번째 플래시 모델 출시입니다. 이 모델의 가격은 입력 토큰 백만 개당 0.75달러, 출력 토큰 백만 개당 3.75달러입니다.

X에서 실시간 최신 뉴스를 확인하십시오

Today we’re introducing a new 3.8 Flash model, our 3rd Flash release in just 6 wks.

It delivers significant leaps from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning. On DeepSWE v1.1, it outperforms most larger frontier models in autonomously… pic.twitter.com/MB5seliluh

— Sundar Pichai (@sundarpichai) September 2, 2026

해당 출시 가격은 2026년 12월 31일까지 유지됩니다. 이후 가격은 각각 1.50달러 및 7.50달러로 2배 인상됩니다.

구글은 범용 모델과 함께 제미니 3.8 플래시 사이버를 선보였습니다. 이 모델은 신뢰받는 방어자 그룹에게 제공됩니다. 사이버짐(CyberGym) 보안 취약점 탐지 벤치마크에서 86.2%의 점수를 획득했습니다.

또한 해당 사이버 모델은 패치 벤치마크인 CWE-벤치에서 47.2%를 기록했습니다. 구글은 이 모델이 상업용 대형 모델보다 크롬 취약점에 대해 2.6배 더 많은 올바른 패치를 제공했다고 밝혔습니다.

접근 권한은 페어윈드 프로그램(Fairwind Program)을 통해 부여되며, 정부 기관 및 주요 인프라 운영자에게 제한됩니다. 오픈AI는 하루 전에 최초로 중요 사이버보안 임계값에 도달한 모델 아스트라(Astra)에 유사한 한계를 적용했습니다.

한편, 메타는 뮤즈 코드 및 메타 모델 API를 통해 뮤즈 스파크 1.3을 공개했습니다. 회사 엔지니어들은 1.2 버전에 비해 툴 호출이 약 20% 감소했다고 측정했습니다.

Muse Spark 1.3 is rolling out today with frontier performance almost too cheap to meter. This is the biggest jump we've made so far on coding and agentic work. Try it in Muse Code and our API.

Next up 🍉 and Muse Spark open weights releases coming soon. pic.twitter.com/XQQEDEJGD7

— Mark Zuckerberg (@finkd) September 2, 2026

제미니 3.8 플래시 대 뮤즈 스파크 1.3: 독립 벤치마크 결과 엇갈려

아티피셜 애널리시스는 두 모델을 테스트했고, 측정 결과에 따르면 각각의 순위가 나타났습니다. 뮤즈 스파크 1.3은 최대 모드에서 GDPval-AA v2 기준 점수 1,754 Elo를 기록했습니다. 제미니 3.8 플래시(상위 버전)는 1,545점을 기록했습니다.

메타는 시에라 리서치 은행 에이전트 테스트(52.4% 대 44.9%)와 CritPt 물리 추론 테스트에서도 선두였습니다. 제미니 3.8 플래시는 터미널-벤치 2.1에서 87.6%, AA-LCR 롱 컨텍스트에서 81%, AA-옴니시언스 정확도에서 55%로 우위였습니다.

제미니 3.8 플래시는 테스트된 모델 중 GPQA 다이아몬드 점수 95%로 최고를 기록했습니다. 인간 최후의 시험(Humanity's Last Exam)에서는 두 모델이 1점 차이로 비슷한 성적을 보였습니다.

메타의 최고 득점 모델은 현재 사용 불가 상태입니다. 회사 측은 안전성 추가 검증이 마무리되면 최대 추론 모델을 출시할 것이라고 밝혔습니다. 현재는 xhigh 버전이 제공됩니다.

해당 버전은 인공지능 지수(Artificial Analysis Intelligence Index)에서 61점을 받아 뮤즈 스파크 1.2보다 4점 앞섰습니다. 그러나 클로드 페이블 5.1(66점), 클로드 오퍼스 5(63점)에는 뒤처졌습니다.

더 많은 모델 출시가 이미 예정되어 있습니다. 일론 머스크는 그록 4.7이 곧 출시된다고 밝혔으며, 곧 2주 안에 4개의 주요 프론티어 모델이 출시될 예정입니다.

YouTube 채널을 구독하시면 주요 인사와 언론인의 전문 인사이트를 시청하실 수 있습니다

https://youtu.be/6uixXOg1e8I

kr.beincrypto.com 에서 Kamina Bashir의 원본 기사 구글·메타 경쟁 AI 모델 동시 공개…승자는? 읽기