AIFreeAPI Logo
2026년 8월 업데이트 • 공식 모델 ID • API 제공 상태

2026 AI 모델 가이드텍스트 • 이미지 • 음성 • 비디오

2026년 8월 기준 주요 AI 모델을 용도별로 비교합니다. Claude Fable 5, GPT-5.6 Sol, Gemini 3.6 Flash의 모델 ID와 가격 범위를 빠르게 확인하세요.

AI 모델 살펴보기
2026년 8월 업데이트 • 공식 모델 ID • API 제공 상태
12
AI 모델
4
카테고리
100%
무료 비교
2026
최신 데이터
4가지 카테고리를 작업, API 단계와 가격으로 비교합니다

2026 AI 모델 카테고리

AI 텍스트 생성

2026년 8월 업데이트
GA·프리뷰 API

복잡한 추론, 코딩, 에이전트 작업용 최신 LLM을 공식 모델 ID, 컨텍스트, 도구, API 단계와 가격으로 비교합니다.

AI 코딩 에이전트
3 개 모델

Claude Fable 5

Flagship
최상위 ClaudeAnthropic2026-07

Anthropic이 일반 제공하는 최상위 모델입니다. 장기 추론, 에이전트 개발, 복잡한 지식 업무에 적합하며 거부 응답의 폴백 설계가 필요합니다.

글로벌 API
핵심 기능
모델 ID claude-fable-5
1M 컨텍스트
최대 128K 출력

가격

$10/M input + $50/M output

업데이트

2026-07

OpenAI GPT-5.6 Sol

Flagship
GPT-5.6 플래그십OpenAI2026-07

GPT-5.6 제품군의 플래그십입니다. 복잡한 전문 업무, 코딩, 컴퓨터 사용, 장기 에이전트 워크플로에 맞춰졌습니다.

글로벌 API
핵심 기능
모델 ID gpt-5.6-sol
1.05M 컨텍스트
최대 128K 출력

가격

$5/M input + $30/M output

업데이트

2026-07

Google Gemini 3.6 Flash

GA
최신 안정형 FlashGoogle2026-07

에이전트 및 멀티모달 작업을 위한 Google의 최신 안정형 Flash입니다. 속도, 성능, 토큰 효율의 균형을 목표로 합니다.

Gemini API(GA)
핵심 기능
모델 ID gemini-3.6-flash
1M 컨텍스트
최대 64K 출력

가격

$1.50/M input + $7.50/M output

업데이트

2026-07

AI 이미지 생성

2026년 8월 업데이트
생성·편집 API

복잡한 지시, 타이포그래피, 다중 참조와 프로덕션 작업에 맞는 최신 이미지 생성·편집 모델을 비교합니다.

AI 마케팅 디자인
3 개 모델

GPT Image 2

GA
최신 이미지 모델OpenAI2026-04

OpenAI의 현행 이미지 생성·편집 모델입니다. gpt-image-2-2026-04-21 스냅샷 기준으로 고품질 생성, 편집, 유연한 크기, 고충실도 입력을 다룹니다.

글로벌 API
핵심 기능
모델 ID gpt-image-2
2026-04-21 스냅샷
이미지 생성·편집

가격

OpenAI image API pricing

업데이트

2026-04

FLUX.2 Pro

GA
프로덕션 이미지Black Forest Labs2026-04

Black Forest Labs의 프로덕션용 이미지 생성·편집 모델입니다. 빠른 제작 흐름과 여러 참조 이미지를 쓰는 작업에 적합합니다.

전 세계 사용 가능
핵심 기능
생성·이미지 편집
최대 8개 참조
프로덕션 워크플로

가격

From $0.03/image

업데이트

2026-04

Gemini 3 Pro Image

GA
차세대Google2026-05

Google의 고난도 이미지 작업용 모델입니다. 추론 기반 멀티턴 생성과 편집에 강하고 복잡한 지시 재현성이 높습니다.

Gemini API
핵심 기능
복잡한 이미지 추론
멀티턴 편집
정밀 텍스트 렌더링

가격

~$0.13/image (1-2K)

업데이트

2026-05

AI 음성 합성

2026년 8월 업데이트
음성·TTS API

추론, 도구 호출, 멀티모달 컨텍스트, 인터럽트 처리와 표현력 있는 합성을 지원하는 음성·TTS 모델을 비교합니다.

AI 음성 에이전트
3 개 모델

GPT-Realtime-2.1

GA
추론형 음성OpenAI2026-07

OpenAI의 추론형 실시간 음성 모델입니다. 잡음, 무음, 중단 처리 성능을 개선해 복잡한 음성 에이전트에 적합합니다.

글로벌 API
핵심 기능
모델 ID gpt-realtime-2.1
128K 컨텍스트
음성 입출력

가격

$32/M audio input + $64/M output

업데이트

2026-07

Gemini 3.1 Flash Live

Preview
Live 음성Google2026-07

저지연 음성 대화용 Gemini Live 모델입니다. 음향 뉘앙스, 숫자 인식, 멀티모달 입력과 도구 호출을 지원합니다.

Gemini API(프리뷰)
핵심 기능
모델 ID gemini-3.1-flash-live-preview
음성 대 음성
저지연

가격

$3/M audio input + $12/M output

업데이트

2026-07

Eleven v3

GA
자연 음성ElevenLabs2026-02

ElevenLabs의 현행 주력 TTS입니다. 감정 지시, 억양 변화, 대화형 표현 제어에 강해 자연스러운 음성 제작에 적합합니다.

전 세계 사용 가능
핵심 기능
프롬프트 제어
감정 표현
음성 복제

가격

From $5/mo (30K chars)

업데이트

2026-02

AI 영상 생성

2026년 8월 업데이트
생성·편집 API

오디오 포함 짧은 영상, 대화형 수정, 멀티모달 참조와 API 워크플로를 지원하는 영상 생성·편집 모델을 비교합니다.

AI 비디오 마케팅
3 개 모델

Gemini Omni Flash

Preview
대화형 영상 편집Google DeepMind2026-06

Google이 기본 용도로 권장하는 빠른 영상 생성·대화형 편집 모델입니다. 짧은 영상을 만들고 자연어로 여러 차례 수정할 수 있습니다.

Gemini API(프리뷰)
핵심 기능
모델 ID gemini-omni-flash-preview
3~10초·720p
대화형 편집

가격

Gemini API preview pricing

업데이트

2026-06

OpenAI Sora 2

API
물리 사실성OpenAI2026-02

OpenAI의 영상+오디오 모델입니다. 대사 동기화, Cameos, 다양한 해상도를 API로 사용할 수 있습니다.

글로벌 API
핵심 기능
API: $0.10-0.50/초
720p-1792p 출력
대사 동기화

가격

$0.10/sec (720p) API

업데이트

2026-02

Seedance 2.0

API
몰입형 비디오ByteDance Seed2026-03

ByteDance Seed의 최신 비디오 모델입니다. 오디오-비디오 동시 생성과 이미지·오디오·비디오 참조 기반 연출 제어에 강합니다.

Seed / Volcano Engine
핵심 기능
오디오-비디오 공동 생성
이미지·오디오·비디오 참조
디렉터급 제어

가격

Contact sales

업데이트

2026-03

전문가 추천

이 가이드에서 확인할 내용

작업에 맞는 후보를 고른 뒤 현재 API 계약과 가격을 확인하세요

현재 모델 ID

제품명과 실제 API 호출 ID를 구분

가격 범위

공개 API 요금 또는 공식 가격 경로를 표시

제공 단계

GA, 프리뷰, 제한 제공 여부를 구분

작업 적합성

텍스트, 이미지, 음성, 영상 작업별로 비교

지금 시작하기

시작할 준비가 되었나요?

용도에 맞는 AI 카테고리를 선택하고 바로 구축하세요

무료 API 크레딧
24/7 지원
충실한 문서