Gemini 4 Argon 공개, 일반 사용자는 언제 쓸 수 있나

Gemini 4 Argon은 2026년 9월 30일 구글 공식 블로그에서 발표된 프론티어 모델입니다. 한국 시각으로는 10월 1일 새벽에 소식이 퍼졌지만, 제미나이 앱이나 일반 API에서 바로 고를 수 있는 모델은 아닙니다. 지금은 Fairwind 프로그램의 보안 방어 파트너에게 먼저 열리고, 개발자·기업·일반 사용자는 가드레일을 다듬은 뒤 유료 API와 Google AI Ultra부터 차례로 열린다는 일정이 나와 있습니다. 날짜는 없습니다.

한눈에 결론

  • 지금 쓸 수 있는 쪽은 정부, 필수 인프라, 핵심 기술 플랫폼 등 심사된 보안 방어 조직입니다.
  • 출력 한도는 기존 6만 4천 토큰에서 100만 토큰으로 늘었다고 구글이 밝혔습니다.
  • 도입가는 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러입니다. 도입 기간이 끝나면 4달러와 20달러로 올라갑니다. 기간 길이는 공개되지 않았습니다.
  • 코딩·지식 작업 벤치마크 일부에서는 앞서지만, FrontierSWE v2와 Terminal-bench 4.0에서는 GPT-6 Astra나 Claude Opus 5.5에 뒤집니다.
  • 일반 사용자는 출시일을 기다리기보다, 지금 쓰는 모델의 출력 한도와 보안 도구 정책을 먼저 확인하는 편이 맞습니다.

Gemini 4 Argon, 지금 앱에서 바로 쓸 수 있나

발표문 작성자는 구글 딥마인드 수석 부사장 겸 구글 최고 AI 설계자 Koray Kavukcuoglu입니다. 본문은 소프트웨어 개발, 법률·금융 같은 기업 지식 작업, 사이버 방어에서 긴 작업을 처리하도록 만들었다고 설명합니다. 다만 배포 순서는 성능 소개와 분리해서 읽어야 합니다.

1단계는 Fairwind 프로그램입니다. 구글 딥마인드 설명에 따르면 우선 대상은 공공 네트워크를 지키는 정부와 국가 사이버 기관, 의료·통신·에너지·금융처럼 필수 서비스를 운영하는 조직, 많은 하위 사용자에게 영향을 주는 핵심 기술 플랫폼입니다. 신청 조직은 윤리 운영과 보안 이력을 심사받습니다. 방어 벤치마크를 하는 학술 기관도 신청할 수 있고, 학생 사용은 구글 클라우드의 CodeMender 쪽을 권한다고 적혀 있습니다.

접근 조건도 일반 베타와 다릅니다. 파트너 조직은 모델을 공유하거나 재판매할 수 없습니다. 사용자별 인증, 피싱에 강한 다요소 인증, 접근 통제가 조건입니다. Gemini 4 Argon 권한은 내부 사이버 보안, 사고 대응, 모의 침투 팀에만 줄 수 있고 직원별 사용을 추적해야 합니다. 허용 작업은 허가된 위협 모의, 리버스 엔지니어링, 악성코드 분석처럼 방어와 학술 목적의 이중 용도 작업입니다. Gemini Enterprise의 관리형 모델로 직접 쓰면 제로 데이터 보존을 지원한다고 안내합니다.

2단계는 아직 일정표가 없습니다. 구글은 미국 정부의 자발적 사전 공개 접근 절차에 참여 중이며, 초기 테스터 피드백으로 가드레일을 고친 뒤 개발자, 기업, 소비자에게 연다고 했습니다. 그 시작점은 유료 API 고객과 Google AI Ultra 구독자라고 적혀 있습니다. 무료 제미나이 앱 기본 모델이 되는 시점, 한국 계정 반영 시점, 기업 계약 상품명은 발표문에 없습니다.

방패가 켜진 문 하나만 열리고 나머지 두 문은 닫혀 있는 단계적 공개 이미지
지금은 보안 방어 파트너용 문만 열려 있고, API와 일반 구독은 닫혀 있습니다.

출력 100만 토큰은 긴 작업을 어디까지 바꾸나

구글이 숫자로 못 박은 변화는 출력 한도입니다. 이전 6만 4천 토큰에서 100만 토큰으로 늘었고, 한 번에 수십만 토큰을 생성할 수 있다고 했습니다. 토큰은 모델이 읽고 쓰는 텍스트 조각입니다. 한국어는 같은 분량이라도 영어보다 토큰이 더 드는 경우가 많아서, 100만 토큰이 곧 한국어 100만 단어는 아닙니다.

이 한도가 의미 있는 작업은 긴 패치, 대규모 코드 이전, 여러 문서를 이어 붙인 조사 초안처럼 중간 끊김이 비용을 만드는 일입니다. 구글은 내부에서 C/C++ 코드를 Rust로 옮기는 작업에 이미 쓰고 있다고 밝혔습니다. 규모는 re2, libgav1처럼 수만 줄에서 Fuchsia Zircon 커널 80만 줄 이상까지라고 합니다. libgav1 사례에서는 기존 Rust 이식본의 SIMD 코드 3만 2천 줄을 여러 차례의 프로파일 실험으로 바꾸고, 컴파일러가 자동으로 벡터화하도록 안전한 Rust를 만들었다고 했습니다. 결과는 영상 출력이 같고 Rust 이식본보다 2.7배 빠른 디코더이며, 최적화된 C++에는 아직 못 미친다고 적혀 있습니다.

다른 내부 사례도 회사 발표입니다. 양자 연산 연구팀이 병목이 되는 서브루틴의 시공간 자원(큐비트 × 게이트)을 줄였고, 한 예에서는 몇 분 만에 공개된 기준선보다 40% 낮췄다고 합니다. 데이터센터 메모리 최적화는 적용분 300 TiB 이상, 추정 절감 500 TiB에서 1 PiB라고 했습니다. 독립 감사 수치는 아닙니다. 외부 팀이 같은 저장소를 같은 조건으로 재현했다는 자료도 없습니다.

비교 대상의 출력 한도는 다릅니다. OpenAI API 안내 기준 GPT-6 Astra와 GPT-6.1 Sol의 최대 출력은 12만 8천 토큰입니다. 긴 패치를 한 응답에 담아야 하는 작업이라면 한도 차이가 가격보다 먼저 보일 수 있습니다. 반대로 짧은 요약, 일반 채팅, 간단한 코드 수정이라면 100만 출력은 체감되지 않습니다. 입력 창 크기는 발표문이 출력 한도처럼 한 줄로 못 박지 않았습니다. 딥마인드 평가표의 GraphWalks가 25만 6천에서 100만 토큰 구간을 재므로, 긴 입력을 시험했다는 사실까지만 확인됩니다.


벤치마크에서 앞선 항목과 뒤진 항목

아래 점수는 구글 딥마인드 모델 페이지가 2026년 10월 2일 기준으로 공개한 자체 비교입니다. 평가 주체가 구글이므로, 독립 재현 점수와 같다고 보면 안 됩니다. 방법론은 딥마인드 평가 안내 페이지에 따로 있습니다.

평가 Gemini 4 Argon GPT-6 Astra Claude Fable 5.1 Claude Opus 5.5
Vals Index 68.9% 63.1% 65.8% 67.0%
AutomationBench 51.3% 41.4% 31.4% 42.5%
Vals Finance Agent v2 65.4% 53.5% 58.9% 58.6%
Harvey 법률 에이전트 19.6% 5.4% 6.7% 3.8%
DeepSWE v1.1 77.9% 74.1% 67.4% 74.2%
FrontierSWE v2 55.0% 65.5% 56.3% 62.3%
Terminal-bench 4.0 57.4% 58.2% 57.9% 66.4%
CWE-bench v1 68.0% 68.0% 58.0% 67.0%
LVBench 91.7% 87.5% 79.7% 83.7%

앞서는 쪽은 지식 작업과 일부 장기 코딩입니다. Vals Index는 금융, 코딩, 법률, 세무를 미국 GDP 비중으로 가중한다고 구글이 설명합니다. Zapier의 AutomationBench는 업무 기능의 끝까지 실행을 재며 51.3%로 1위라고 했습니다. DeepSWE v1.1은 77.9%로 상태 최고라고 적었습니다. 긴 영상 이해 LVBench도 91.7%입니다.

절대 점수가 낮은 항목도 같이 봐야 합니다. Harvey 법률 에이전트 벤치마크는 19.6%로 비교 모델보다 높지만, 다섯 건 중 한 건도 안정적으로 넘기지 못하는 수준입니다. 법률 초안을 그대로 써도 된다는 근거가 아닙니다. AutomationBench 51.3%도 절반 안팎이라, 사람 검토 없는 업무 대행으로 읽으면 과합니다.

뒤지는 코딩 평가도 있습니다. FrontierSWE v2는 55.0%로 GPT-6 Astra 65.5%, Claude Opus 5.5 62.3%보다 낮습니다. Terminal-bench 4.0은 57.4%로 Astra 58.2%와 비슷하고 Opus 5.5 66.4%보다 낮습니다. 저장소 에이전트 코딩을 한 점수로 고르면 안 되는 이유입니다. CWE-bench v1 취약점 수정은 Astra와 68%로 동률이고, Fable 5.1 58%, Opus 5.5 67%입니다.


보안 기능이 가드레일 없이 먼저 열리는 이유

구글은 Gemini 4 Argon을 사이버 방어에 강하게 학습시켰고, 취약점을 스스로 찾아 검증하고 고칠 수 있다고 했습니다. 신뢰된 방어자와 구글 내부 팀에는 사이버 가드레일 없이 제공해 방어 성능을 끝까지 쓰게 한다고 명시했습니다. 일반 공개 전에는 악용 거부, 프롬프트 인젝션 방어, 사고 과정과 행동 감시, 샌드박스 격리라는 네 축의 안전장치를 더 강화한다고 했습니다.

초기 사례로, 전 세계 병원이 쓰는 소프트웨어에서 민감 개인정보가 노출될 수 있는 치명 취약점을 찾았고 이전 프론티어 모델은 놓쳤다고 밝혔습니다. 이건 구글의 시연 주장입니다. 해당 병원 소프트웨어 이름, CVE 번호, 독립 재현 여부는 발표문에 없습니다. Wiz의 Scan for Good 이니셔티브 링크는 걸려 있지만, 그 페이지가 이 특정 결함을 확정 공개했다는 뜻으로 단정할 자료는 이번 확인 범위에 없습니다.

추상 패턴만 뜬 모니터가 놓인 보안 분석 작업 공간
방어 파트너에게는 가드레일 없는 보안 기능이 먼저 열립니다. 화면의 패턴은 실제 탐지 결과가 아닙니다.

Fairwind 파트너는 이 모델을 CodeMender와 함께 쓸 수 있습니다. CodeMender는 취약점 조사와 패치를 돕는 코드 보안 에이전트이고, 팀이 자체 하네스를 유지하지 않아도 된다고 안내합니다. 3.8 Flash Cyber 대비 취약점 발견이 늘었다는 표현도 회사 주장입니다. 내부 벤치마크에서는 20개 언어의 복잡한 코드베이스에서 더 넓은 노출을 찾았다고 하고, Wiz의 블랙박스 웹 침투 벤치마크에서도 3.8 Flash Cyber보다 높았다고 보안 매체가 전했습니다. 원점수표는 구글 블로그 본문에 붙어 있지 않습니다.

가드레일 없는 배포가 위험한 이유도 같이 있습니다. 방어 팀이 모의 침투와 악성코드 분석에 쓰려면 공격 코드에 가까운 출력이 필요할 수 있습니다. 그래서 구글은 대상을 심사된 조직의 보안 직무로 제한했습니다. 일반 계정에 같은 모드가 열릴지는 발표되지 않았습니다. 넓은 공개 때는 유해 요청 거부와 이중 용도 연구 허용을 Frontier Safety Framework에 맞춘다고만 되어 있습니다.

팩트체크

  • 현재 판정: 일부 사실. 모델 발표, 단계 공개, 도입가, 출력 한도는 공식 확인. 일반 출시일과 병원 취약점의 독립 검증은 미확인.
  • 원출처: 구글 블로그 발표문(2026-09-30), 딥마인드 모델 페이지, Fairwind 프로그램 페이지.
  • 확인된 부분: Fairwind 우선 배포, 유료 API와 Google AI Ultra부터 확대 예정, 출력 100만 토큰, 도입가 2달러/10달러와 이후 4달러/20달러, 캐시 입력 95% 할인.
  • 미확인 부분: 도입가 종료일, 한국 앱 반영일, 무료 사용자 제공 여부, 병원 소프트웨어 이름과 CVE.
  • 협력업체 주장: Wiz 벤치마크 언급은 구글·보안 매체 인용 단계이며, 제조사 공식 블로그의 한 줄 주장과 별도 원자료로 세지 않는 것이 맞습니다.

도입가 2달러는 나중 가격이 아니다

공식 각주가 중요합니다. 도입가는 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러입니다. 캐시된 입력은 입력가에서 95% 할인입니다. 도입가 기준으로 계산하면 캐시 입력은 100만 토큰당 0.10달러입니다. 도입 기간이 끝나면 입력 4달러, 출력 20달러가 적용됩니다. 그 기간이 며칠인지는 없습니다. 견적을 도입가로만 잡으면 이후 단가가 두 배가 됩니다.

항목 Gemini 4 Argon GPT-6 Astra GPT-6.1 Sol
지금 쓸 수 있나 Fairwind 보안 파트너 API에 공개 API에 공개
입력 100만 토큰 도입 2달러, 이후 4달러 10달러 2달러
출력 100만 토큰 도입 10달러, 이후 20달러 50달러 10달러
최대 출력 100만 토큰 12만 8천 토큰 12만 8천 토큰

OpenAI API 페이지의 표준 처리 요금은 컨텍스트 27만 2천 토큰 미만 기준입니다. Astra는 그 구간을 넘으면 입력과 캐시가 2배, 출력이 1.5배라고 안내합니다. Argon의 장문 할증은 발표문에 없습니다. 그래서 100만 토큰 입력을 넣는 실제 청구액은 아직 비교할 수 없습니다. Sol은 입출력 단가가 Argon 도입가와 같지만 최대 출력이 12만 8천 토큰입니다. 짧은 호출이 많다면 Sol이 이미 열려 있는 대안이고, 아주 긴 한 응답이 필요하면 Argon의 한도가 차이가 됩니다. 그 한도를 지금 사려면 Fairwind 조건을 충족해야 합니다.


개발자와 일반 사용자가 지금 확인할 것

개인 사용자에게 당장 필요한 행동은 거의 없습니다. 제미나이 앱 모델 목록에 Argon이 없어도 계정 오류가 아닙니다. Ultra 구독만으로 오늘 열린다는 안내도 없습니다. 구글은 Ultra를 이후 확대의 시작점으로 적었을 뿐입니다.

개발 팀은 세 가지를 나눠 보면 됩니다. 첫째, 지금 돌려야 하는 코딩 에이전트라면 공개된 Astra, Sol, Claude 계열로 같은 저장소를 먼저 재는 편이 낫습니다. Argon이 DeepSWE에서는 앞서고 FrontierSWE v2에서는 뒤지므로, 자체 저장소 점수가 없으면 이름만으로 교체 근거가 약합니다. 둘째, 출력 한도 때문에 패치가 끊기는 작업이라면 공개 후 재시험 후보로 올려 두되, 도입가 종료일을 확인하기 전에는 연간 예산을 2달러/10달러로 고정하지 않는 것이 안전합니다. 셋째, 보안 조직이라면 Fairwind 신청 조건을 봅니다. 정부, 필수 인프라, 핵심 플랫폼, 방어 연구 학술 기관이 우선이고, 일반 앱 개발사나 개인 연구자는 대상이 아닙니다.

보안 담당자가 신청한다면 계정 공유 금지, 보안 직무 한정, 다요소 인증, 사용 추적, 방어 목적 제한을 내부 정책으로 맞출 수 있는지도 봐야 합니다. 조건을 맞출 수 없으면 신청서만으로는 의미가 없습니다. CodeMender를 이미 쓰는 팀은 Argon이 붙었을 때의 패치 검토 절차를 먼저 정하는 편이 좋습니다. 자동 패치를 바로 배포하는 구조는 발표문도 권하지 않습니다.

공개 대상, 출력 한도, 도입가, 일반 사용자 불가를 적은 Gemini 4 Argon 확인 포인트
지금 확인 포인트는 대상, 출력 한도, 도입가, 일반 사용자 불가 네 가지입니다.

3.8 Flash Cyber를 쓰던 팀은 무엇을 바꾸나

이미 Fairwind나 CodeMender로 Gemini 3.8 Flash Cyber를 쓰던 조직이라면, 앱 전환이 아니라 권한과 검토 절차를 먼저 보면 됩니다. 구글은 Argon이 3.8 Flash Cyber보다 취약점 발견이 늘었다고 했지만, 공개 블로그에는 언어별 원점수표가 없습니다. 내부 벤치마크에서 20개 언어의 코드베이스를 봤다는 설명과, Wiz 블랙박스 웹 침투에서 앞섰다는 매체 인용만 있습니다. 그래서 기존 하네스의 탐지 목록을 Argon으로 다시 돌리기 전에는 교체 완료로 처리하지 않는 것이 맞습니다.

운영에서 달라지는 지점은 세 가지입니다. 가드레일 없는 방어 모드가 같은 조직의 보안 직무에만 열린다는 점, 출력 한도가 6만 4천 토큰에서 100만 토큰으로 늘어 긴 패치가 한 응답에 들어올 수 있다는 점, 도입가와 이후 가격이 달라 청구 예산을 따로 잡아야 한다는 점입니다. 자동 수정 결과를 저장소에 바로 병합하는 규칙은 Argon에서도 그대로 두면 위험합니다. 패치 설명, 재현 절차, 사람 승인 단계를 유지하는 쪽이 발표문이 말하는 검증 흐름과 맞습니다.

아직 Fairwind 밖인 팀은 3.8 Flash Cyber가 자기 계정에 열려 있는지만 확인하면 됩니다. Argon 발표가 기존 모델의 종료 공지는 아닙니다. 종료일, 마이그레이션 마감, 한국 리전 제한은 이번 발표에 없습니다.


자주 나오는 질문

제미나이 앱에서 Gemini 4 Argon이 안 보이면 오류인가요?
아닙니다. 2026년 10월 2일 기준으로 일반 앱 공개는 시작되지 않았습니다. 목록에 없는 것이 현재 배포 상태와 맞습니다.

Fairwind는 누구나 신청할 수 있나요?
양식은 있지만 심사가 있습니다. 우선 대상은 정부, 필수 인프라, 핵심 기술 플랫폼이고, 학술 기관은 방어 벤치마크 목적이 적혀 있습니다. 개인 계정 지급은 안내되지 않았습니다.

2달러 가격은 계속되나요?
도입가입니다. 기간 종료 후 입력 4달러, 출력 20달러라고 각주에 있습니다. 종료일은 없습니다.

병원 소프트웨어 취약점은 확정된 사고인가요?
구글이 모델 시연으로 찾은 치명 결함이라고 주장한 내용입니다. 제품명과 CVE, 독립 검증은 발표문에 없습니다.

확인일: 2026년 10월 2일. 원문: 구글 블로그 Gemini 4 Argon 발표, 딥마인드 모델 페이지, Fairwind 프로그램, OpenAI API 요금.

0 0 votes
Article Rating
Subscribe
Notify of
guest
0 Comments
Oldest
Newest Most Voted
0
Would love your thoughts, please comment.x
()
x