2026 AI 모델 가이드텍스트 • 이미지 • 음성 • 비디오
2026년 9월 기준 주요 AI 모델을 용도별로 비교합니다. Claude Fable 5.1, GPT-6 Astra, Gemini 3.8 Flash의 모델 ID와 가격 범위를 빠르게 확인하세요.
2026 AI 모델 카테고리
AI 텍스트 생성
복잡한 추론, 코딩, 에이전트 작업용 최신 LLM을 공식 모델 ID, 컨텍스트, 도구, API 단계와 가격으로 비교합니다.
Claude Fable 5.1
일반 모델로 해결하기 어려운 추론, 장시간 에이전트 작업, 여러 단계의 조사에 적합합니다.
핵심 기능
업데이트
2026-09
GPT-6 Astra
복잡한 코딩·조사·문서 작업에 적합하며 이미지 입력, 도구 호출, 구조화된 출력을 지원합니다.
핵심 기능
업데이트
2026-09
Gemini 3.8 Flash
비용을 고려한 코딩과 멀티모달 분석에 적합합니다. 텍스트·이미지·영상·음성·PDF를 입력받아 텍스트를 출력합니다.
핵심 기능
업데이트
2026-09
AI 이미지 생성
복잡한 지시, 타이포그래피, 다중 참조와 프로덕션 작업에 맞는 최신 이미지 생성·편집 모델을 비교합니다.
GPT Image 2
세부 지시와 참조 이미지의 특징을 반영한 이미지 생성·편집에 적합합니다.
핵심 기능
가격
업데이트
2026-09
FLUX.2 Pro
여러 참조 이미지를 활용해 시각 소재를 반복 제작하는 작업에 적합합니다.
핵심 기능
업데이트
2026-09
Nano Banana Pro
복잡한 시각 지시, 브랜드 일관성, 정밀 디자인에 적합하며 Nano Banana Pro라고도 합니다.
핵심 기능
가격
업데이트
2026-09
AI 음성 합성
추론, 도구 호출, 멀티모달 컨텍스트, 인터럽트 처리와 표현력 있는 합성을 지원하는 음성·TTS 모델을 비교합니다.
GPT-Realtime-2.1
중간에 끼어들 수 있는 실시간 음성 대화와 추론·도구 호출을 지원합니다.
핵심 기능
업데이트
2026-09
Gemini 3.1 Flash Live
Live API를 통한 저지연 음성 대화와 멀티모달 상호작용을 지원합니다.
핵심 기능
가격
업데이트
2026-09
Eleven v3
오디오 태그로 말투를 제어하는 감정 표현이 풍부한 더빙·캐릭터 대화·내레이션에 적합합니다.
핵심 기능
가격
업데이트
2026-09
AI 영상 생성
오디오 포함 짧은 영상, 대화형 수정, 멀티모달 참조와 API 워크플로를 지원하는 영상 생성·편집 모델을 비교합니다.
Gemini Omni 1.1 Flash
자연어 지시로 짧은 영상을 반복 수정하는 대화형 생성·편집에 적합합니다.
핵심 기능
가격
업데이트
2026-09
Veo 3.1
동기화된 오디오와 연출 제어가 필요한 짧은 영상에 적합하며 Standard·Fast·Lite를 선택할 수 있습니다.
핵심 기능
가격
업데이트
2026-09
Seedance 2.5
최대 30초의 오디오·영상 동시 생성과 참조 제어, 연장, 세부 편집을 지원합니다.
핵심 기능
가격
업데이트
2026-09
이 가이드에서 확인할 내용
작업에 맞는 후보를 고른 뒤 현재 API 계약과 가격을 확인하세요
현재 모델 ID
제품명과 실제 API 호출 ID를 구분
가격 범위
공개 API 요금 또는 공식 가격 경로를 표시
제공 단계
GA, 프리뷰, 제한 제공 여부를 구분
작업 적합성
텍스트, 이미지, 음성, 영상 작업별로 비교