Skip to Content

비디오 모델

POST /v1/videos에서 12개 모델을 제공합니다. 요청 스키마는 모두 동일하며, 차이는 클립 길이, 프레임 크기, 허용되는 화면비, 초당 요금뿐입니다. 표에서 하나를 고른 뒤 그 ID를 model 필드에 넘기세요.

기능 매트릭스

모델 ID모드해상도(기본값)길이화면비시작 $/초
alibaba/happyhorse-1.0t2v · i2v · v2v720p 1080p1080p3–15초A0.13
alibaba/happyhorse-1.1t2v · i2v720p 1080p1080p3–15초A0.13
alibaba/wan-2.6t2v · i2v720p 1080p1080p2–15초A0.10
alibaba/wan-2.7t2v · i2v · v2v720p 1080p1080p2–15초A0.10
alibaba/wan-3.0t2v · i2v · v2v480p 720p 1080p1080p2–30초C0.054
alibaba/wan-3.0-primet2v · i2v · v2v480p 720p 1080p1080p2–30초C0.064
bytedance/seedance-2.0t2v · i2v · v2v480p 720p 1080p 4k1080p4–15초B0.07
bytedance/seedance-2.0-fastt2v · i2v · v2v480p 720p720p4–15초B0.06
bytedance/seedance-2.0-minit2v · i2v · v2v480p 720p720p4–15초B0.04
bytedance/seedance-2.5t2v · i2v · v2v480p 720p 1080p720p4–30초D0.11
minimax/hailuo-3t2v · i2v · v2v768p 2k768p4–15초D0.08
minimax/hailuo-3-maxt2v · i2v · v2v480p 768p768p5–15초D0.05

모드t2v는 text-to-video, i2v는 image-to-video, v2v는 video-to-video입니다. 모드를 직접 보내지 않으며, 요청에 frame_images 또는 input_references가 있는지로 추론됩니다. 생성 모드를 참조하세요.

화면비 세트 — 각 세트는 바로 위 세트를 포함합니다:

세트
A16:9 9:16 1:1
BA + adaptive
CB + 4:3 3:4
DC + 21:9

오디오 — 12개 모델 모두 동기화된 사운드트랙을 생성하며, generate_audio의 기본값은 true입니다.

시작 $/초pricing.output_video_per_second이며, 해당 모델의 가장 저렴한 tier일 뿐 실제로 지불하는 요금이 아닙니다. 실제 과금되는 요금은 pricing.video_pricing.tiers에서 일치하는 항목이며 해상도, 입력 유형, 오디오에 따라 달라집니다. 완료된 작업의 usage.video_secondsusage.video_cost를 실제 청구 금액으로 사용하세요. 초당 요금을 참조하세요.

video_attributes 객체

Models API 응답의 모든 비디오 모델에는 video_attributes 객체가 포함됩니다. 이 객체가 해당 모델이 무엇을 받아들이는지에 대한 공식 설명이며, 위 매트릭스는 그 스냅샷일 뿐입니다.

{ "modes": ["t2v", "i2v", "v2v"], "resolutions": ["480p", "720p", "1080p"], "default_resolution": "720p", "min_duration_seconds": 4, "max_duration_seconds": 30, "supports_audio": true, "aspect_ratios": ["21:9", "16:9", "4:3", "1:1", "3:4", "9:16", "adaptive"] }
필드타입설명
modesstring[]모델이 제공하는 생성 모드: t2v, i2v, v2v
resolutionsstring[]허용되는 resolution 값이며, 목록에 없는 값은 거부됩니다
default_resolutionstring요청에서 resolutionsize를 모두 생략했을 때 적용됩니다
min_duration_secondsnumberduration의 하한(초 단위)
max_duration_secondsnumberduration의 상한(초 단위)
supports_audiobooleangenerate_audio: true가 사운드트랙을 생성하는지 여부
aspect_ratiosstring[]허용되는 aspect_ratio 값이며, adaptive는 입력 이미지의 비율을 유지합니다

video_attributesresolution, duration, aspect_ratio에 대해 모델별로 신뢰할 수 있는 기준입니다. 동영상 작업 생성에 나온 파라미터 범위는 모든 모델을 한꺼번에 합친 것이므로, 거기에 있는 값이라도 특정 모델에서는 거부될 수 있습니다.

실시간 목록 조회

Models API는 공개 엔드포인트이며 API Key가 필요하지 않습니다. supported_endpoints로 필터링하면 비디오 모델만 남길 수 있습니다:

Terminal
curl -s https://api.ofox.io/v1/models \ | jq -r '.data[] | select(.supported_endpoints[]? == "/v1/videos") | .id'

이 페이지는 스냅샷입니다. 모델은 문서 릴리스 없이 추가되므로, 항상 최신 목록이 필요하면 엔드포인트를 직접 조회하세요.

요구사항으로 고르기

요구사항모델
단일 작업에서 30초alibaba/wan-3.0, alibaba/wan-3.0-prime, bytedance/seedance-2.5
4K 출력bytedance/seedance-2.0
2K 출력minimax/hailuo-3
4초 미만 클립모든 alibaba/* 모델(하한 2초 또는 3초)
video-to-videoalibaba/happyhorse-1.1alibaba/wan-2.6을 제외한 모든 모델
시네마틱 21:9bytedance/seedance-2.5, minimax/hailuo-3, minimax/hailuo-3-max
가장 저렴한 시작 요금bytedance/seedance-2.0-mini, $0.04/초

다음 단계

Last updated on