/// NOTES · 연재 004

제미나이 3.8 플래시, 코드 없이 무료로 눌러 보기

이 글은 그날 쓴 것이 아니다. 2026년 9월 2일 구글이 제미나이 3.8 플래시를 내놓았는데, 그날은 그냥 지나갔다가 나중에 공식 문서를 다시 열어 확인해 적는다. 직접 화면에서 눌러 본 순서가 아니라 문서와 개발자 페이지로 확인한 것이라는 점을 먼저 밝힌다.

2026-09-04· 분류 : 모델· 직접 해 보기 5분· 나중에 채운 글

무엇이 바뀌었나

확인 구글 공식 블로그에 따르면 9월 2일 '제미나이 3.7 플래시' 이후 3주 만에 제미나이 3.8 플래시와 보안 특화 버전 3.8 플래시 사이버가 함께 나왔다. 최근 6주 사이 세 번째 플래시급 모델이다.

바뀐 것내용근거
컨텍스트 창 입력 1,048,576토큰 · 출력 최대 65,536토큰 확인
씽킹 레벨(추론 강도) low · medium(기본) · high 세 단계. 이전에 있던 minimal은 뺐다 — 넣으면 오류 확인
가격 입력 100만 토큰당 0.75달러, 출력 3.75달러. 3.7 플래시와 동일 (2026-12-31까지 도입가, 이후 각 1.50 · 7.50달러) 확인
어디서 쓰나 제미나이 API · AI 스튜디오 · 안드로이드 스튜디오 · 제미나이 엔터프라이즈 확인
3.8 플래시 사이버 정부기관 · 핵심 인프라 운영자 대상 '페어윈드' 프로그램으로만 제공 — 개인 계정에는 안 뜬다 확인

확인 AI 스튜디오(aistudio.google.com)에서는 구글 계정으로 로그인해 API 키를 받으면 신용카드 없이, 무료로 3.8 플래시를 바로 쓸 수 있다. 다만 무료 등급에서 보낸 프롬프트·결과는 구글이 제품 개선에 쓸 수 있다고 안내돼 있다.

추정 벤치마크로는 장기 소프트웨어 엔지니어링 평가 '딥SWE v1.1'에서 73.7%를 기록해 클로드 오퍼스 5(74%)·GPT-5.6 솔(72.7%)과 비슷한 수준이라고 발표됐다. 다만 이건 구글이 자체적으로 잰 값이라 참고 정도로만 둔다.

왜 개인 계정에서도 눈여겨볼 만한가

이 사이트 교육 과정 L0·04 토큰 · 컨텍스트 · 환각에서 다룬 두 가지가 이번 발표에 그대로 겹친다. 하나는 컨텍스트 창 — 100만 토큰이 넘는 창이면 꽤 두꺼운 문서 하나를 통째로 넣고 물어봐도 잘리지 않는다는 뜻이다. 다른 하나는 토큰 소모 — 씽킹 레벨을 high로 올리면 모델이 답하기 전에 스스로 여러 단계를 거치며 도구를 반복 호출하는데, 그만큼 토큰을 더 쓰고 시간도 더 걸린다.

확인 즉 씽킹 레벨은 속도·토큰량·품질을 한 번에 조절하는 손잡이다. 간단한 초안 작성이나 실시간 대화처럼 빨리 받는 게 중요하면 low, 복잡한 코드나 여러 단계짜리 작업이면 기본값인 medium이나 high를 쓰라고 문서에 적혀 있다. 모델을 바꾸지 않고도 같은 모델 안에서 이 손잡이만 돌려 체감을 비교해 볼 수 있다.

직접 해 보기 — 5분

  1. aistudio.google.com/apikey에서 API 키를 받는다. 확인 구글 계정으로 로그인만 하면 되고, 결제 정보를 걸지 않으면 무료 등급으로 쓰인다.
  2. AI 스튜디오 채팅 화면(aistudio.google.com)을 연다. 모델 목록에서 Gemini 3.8 Flash를 고른다. 오른쪽 설정 패널에 씽킹 레벨을 고르는 드롭다운이 있다 — 코드를 한 줄도 안 써도 된다.
  3. 같은 질문을 씽킹 레벨만 바꿔 두 번 넣어 본다.
    친구 다섯 명이 여행 경비 30만원을 나눠 쓰는데
    각자 쓴 금액이 다 다르다. 가장 공평하게
    정산하는 방법을 단계별로 설명해 줘
    먼저 low로 한 번, 그다음 high로 한 번. 걸린 시간과 답의 길이, 중간에 스스로 검산하는 과정이 보이는지를 비교한다.
  4. 코드로 직접 불러 보고 싶으면 파이썬 예시를 쓴다. 확인 — 공식 문서에 실린 그대로다.
    from google import genai
    
    client = genai.Client()
    r = client.interactions.create(
        model="gemini-3.8-flash",
        input="여기에 프롬프트",
        generation_config={"thinking_level": "medium"}
    )
    print(r.output_text)
  5. minimal은 넣지 않는다. 3.7 플래시에 있던 네 번째 단계인데 3.8 플래시에서는 빠졌다. 예전 코드를 그대로 옮겨 쓰면 오류가 난다.
이 글의 한계

확인 못 함 무료 등급의 정확한 분당·일일 호출 한도는 문서마다 숫자가 조금씩 달라 여기서는 적지 않았다. 직접 콘솔의 할당량 화면에서 확인하는 편이 정확하다.

추정 구글은 씽킹 레벨을 medium으로 두면 "대부분의 작업에서 가장 좋은 품질"이라고 적었는데, 이건 구글 기준 판단이라 실제 내 작업에도 그런지는 직접 비교해 봐야 안다.

이 글은 발표 당일에 쓴 것이 아니다. 나중에 공식 문서와 개발자 페이지를 다시 열어 확인하고 채웠다.

한 줄 정리

  1. 9월 2일 나온 제미나이 3.8 플래시는 AI 스튜디오에서 API 키만 받으면 무료로 바로 써 볼 수 있다.
  2. 씽킹 레벨 low·medium·high는 속도·토큰량·품질을 한 번에 조절하는 손잡이다.
  3. 사이버 특화 버전은 개인 계정에는 안 뜬다 — 정부·인프라 운영자 전용이다.
이어 읽기 L0 · 04 토큰 · 컨텍스트 · 환각 — 컨텍스트 창이 크다는 게 정확히 뭘 뜻하는지, 그리고 토큰을 더 쓴다는 게 왜 느려지고 비싸지는지. →
SOURCES
  1. Google — Introducing Gemini 3.8 Flash and 3.8 Flash Cyber (발표일 · 제공 플랫폼 · 사이버 버전 제한 범위)
  2. Google AI for Developers — What's new in Gemini 3.8 Flash (컨텍스트 창 · 출력 한도 · 씽킹 레벨 3단계)
  3. Google AI for Developers — Gemini thinking (thinking_level 파라미터 · 코드 예시)
  4. Google AI for Developers — Gemini API pricing (입출력 단가 · 도입가 종료일)