Gemini 3.7 Flash의 새로운 기능

최신 모델 기타 모델

Gemini 3.7 Flash (gemini-3.7-flash)가 정식 버전 (GA)으로 출시되어 프로덕션에 사용할 수 있습니다. 코딩 및 에이전트를 위한 Google의 가장 지능적인 주력 모델입니다.

이 가이드에서는 Gemini 3.7 Flash의 새로운 기능, API 변경사항, 코드 예시, 마이그레이션 안내를 설명합니다.

새 모델

모델 모델 ID 기본 사고 수준 가격 책정 설명
Gemini 3.7 Flash gemini-3.7-flash medium 3.7 Flash는 연말까지 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $3.75의 신규 할인 가격으로 제공됩니다. 자세한 내용은 가격 책정을 참고하세요. 복잡한 코딩, 에이전트형 워크플로, 안정적인 다단계 실행을 위해 빌드된 Google의 가장 강력한 Flash 모델입니다.

Gemini 3.7 Flash는 1백만 개의 토큰 컨텍스트 윈도우, 최대 64,000개의 출력 토큰, 조정 가능한 사고 수준 (low, medium, high), 3.6 Flash와 동일한 내장 도구 모음을 지원합니다.

전체 사양은 Gemini 3.7 Flash 모델 페이지를 참고하세요. 자세한 가격 정보는 가격 책정 페이지를 참고하세요.

빠른 시작

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.7-flash",
    input="Write a responsive navigation component in React with smooth animations and dark mode toggle."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
  model: "gemini-3.7-flash",
  input: "Write a responsive navigation component in React with smooth animations and dark mode toggle.",
});

console.log(interaction.output_text);

자바

import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;

Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
    .model(Model.of("gemini-3.7-flash"))
    .input(InteractionsInput.of("Write a responsive navigation component in React with smooth animations and dark mode toggle."))
    .build();
Interaction interaction =
    client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.7-flash",
    "input": "Write a responsive navigation component in React with smooth animations and dark mode toggle."
  }'

Gemini 3.7 Flash의 새로운 기능

  • 코딩 및 에이전트 작업: 실제 소프트웨어 엔지니어링 및 에이전트 벤치마크에서 품질이 크게 향상되어 문제 해결이 개선되고 에이전트 루프 실패가 줄어듭니다.
  • 웹 개발 및 강력한 디자인 패리티: 디자인 모의에서 직접 충실도가 높은 데스크톱 및 웹 애플리케이션 코드를 생성하여 디자인 준수 및 모의에 대한 기존 코드베이스 감사에서 1:1 디자인 패리티를 검증하는 데 큰 이점을 제공합니다.
  • 프로모션 가격: Gemini 3.7 Flash는 신규 할인 가격인 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $3.75로 제공됩니다. 이 새로운 요금은 3.6 Flash에도 적용됩니다. 도입 가격은 2026년 12월 31일에 만료되며, 이후에는 입력 토큰 100만 개당 $1.50, 출력 토큰 100만 개당 $7.50가 적용됩니다.

적절한 모델 선택

다음 표를 참고하여 워크로드에 권장되는 마이그레이션 대상을 검토하세요. Gemini 3.5 Flash, Gemini 3 Flash (프리뷰) 또는 Gemini 3.1 Pro에서 업그레이드하려면 지원 중단된 샘플링 매개변수 (temperature, top_p, top_k)와 사전 입력된 모델 턴을 삭제해야 합니다. Gemini 3.6 Flash에서는 이미 이러한 매개변수가 더 이상 지원되지 않습니다.

모델 주요 사용 사례 권장되는 마이그레이션 대상
Gemini 3.7 Flash
gemini-3.7-flash
코드 생성, 공간/멀티모달 추론, 다단계 에이전트형 워크플로, 설계 준수 Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash (프리뷰), Gemini 3.1 Pro

추론 수준 이해하기

Gemini 3.7 Flash를 사용하면 모델의 사고 수준을 조정하여 지연 시간과 인텔리전스를 유연하게 제어할 수 있습니다.

  • 사고 대응 파이프라인, 실시간 채팅, 초안 작성, 빠른 데이터 분석과 같은 지연 시간에 민감한 작업의 응답 시간 단축: 사고 대응 파이프라인, 실시간 채팅, 초안 작성, 빠른 데이터 분석과 같은 지연 시간에 민감한 작업의 응답 시간을 단축합니다.
  • 중간 (기본값): 대부분의 작업에 가장 적합한 품질입니다. 복잡한 코드 및 에이전트 사용 사례에 권장되며, 초기 정확도가 높습니다.
  • 높은 사고 노력: 모델이 사고하고 도구를 사용할 수 있는 능력을 극대화합니다. 복잡한 추론, 어려운 수학, 까다로운 코딩 및 에이전트 작업에 가장 적합합니다. 토큰 소비량과 비용이 더 높으며 확장된 생각과 함수 호출을 허용합니다.

Gemini 3.7 Flash에서 사고 수준을 구성하려면 다음 단계를 따르세요.

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.7-flash",
    input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
    generation_config={
        "thinking_level": "medium"  # Balanced reasoning effort for complex tasks
    }
)

print(interaction.output_text)

다국어 코드 예시 (JavaScript, Java, Go, REST) 및 심층적인 추론 개념은 Gemini 3.8 Flash의 추론 수준 이해하기를 참고하세요.

Antigravity 에이전트 지원

Gemini 3.7 Flash는 Gemini 관리 에이전트 및 Google Antigravity SDK에서 Antigravity 에이전트를 지원합니다.

최신 코드 샘플과 최신 기본 에이전트 구성은 Antigravity 에이전트 가이드 및 Gemini 3.8 Flash 가이드를 참고하세요.

마이그레이션 체크리스트

  `/gemini-api-dev migrate my app to Gemini 3.7 Flash`

gemini-3.7-flash로 마이그레이션

  • 모델 ID 업데이트: 타겟 모델 문자열을 gemini-3.7-flash로 변경합니다.
  • 사고 수준 구성: thinking_budget을 문자열 enum thinking_level로 바꾸고 워크로드에 필요한 대로 "low", "medium" (기본값) 또는 "high"로 설정합니다.
  • Gemini 3 API 파라미터 변경사항 적용: 지원 중단된 샘플링 파라미터 (temperature, top_p, top_k), candidate_count (Gemini 3 이상에서 지원되지 않음), 사전 입력된 모델 턴을 삭제합니다. Gemini 3.6 API 변경사항 및 파라미터 업데이트를 참고하세요.
  • 기준 Gemini 3.x 요구사항: 함수 호출 엄격한 응답 일치, SDK 업데이트, 생각 서명 보존에 관한 내용은 Gemini 3.5 이전 체크리스트를 참고하세요.

가격 책정

전체 가격 세부정보와 할인 요금은 가격 책정 페이지를 참고하세요.

다음 단계