Seedance 2.5 서비스 시작 — Atlas Cloud 최초 공개

MiniMax H3 Open Source Weights: 슈퍼컴퓨터가 필요하지 않습니다. 변호사가 필요할 수도 있습니다.

MiniMax H3 오픈소스 가중치가 공개되었습니다: 33B 파라미터, 최소 42.5GB 다운로드, 두 개의 체크포인트, 그리고 라이선스의 지역 조항은 미국, EU, 영국, 한국을 제외합니다.

코드가 표시된 노트북과 책상 위에서 빛나는 PC

새벽 3시 책상, 열린 PC 케이스와 외장 드라이브, 대용량 다운로드가 진행 중인 모니터

가중치가 공개되었습니다. 그럼 MiniMax의 출시 게시글에서 가장 많은 댓글이 달린 두 가지 질문에 먼저 답변드리겠습니다.

아니요, 슈퍼컴퓨터가 필요하지 않습니다. 올바른 파일을 선택하면 다운로드 용량은 123.6GB가 아닌 42.5GB입니다. 모델은 33B 파라미터이며, 그중 약 13B는 추론에 로드할 필요가 없는 AdaLN 변조 브랜치에 있습니다.

그다음 LICENSE 파일을 열었습니다. 10번째 줄, 2000만 달러 수익 조항보다 먼저 등장하는 것은 국가 목록입니다. 제 국가가 포함되어 있습니다. 아마 여러분 국가도 포함되어 있을 겁니다.

핵심 요약

  • MiniMax H3 오픈 소스 가중치가 Hugging Face에 MiniMaxAI/MiniMax-H3로, 그리고 ComfyUI 재패키징 미러인 Comfy-Org/MiniMax-H3로 공개되었습니다. ComfyUI는 같은 날 기본 지원을 출시했습니다.
  • 하나의 파일이 아닙니다. 두 가지 작업별 체크포인트, fl2va(텍스트 및 이미지 기반)와 ref2va(참조 기반)가 있으며, 각각 최소 형태로 21GB입니다. 작업에 필요한 하나만 다운로드하면 됩니다.
  • 33B 밀집 단일 스트림 Transformer. 가장 작은 작업 조합은 42.5GB로, 전체 정밀도 123.6GB에서 66% 감소했습니다. ComfyUI는 12GB 카드와 오프로딩으로 실행 가능하다고 밝혔습니다.
  • 로컬 생성은 기본적으로 짧은 쪽 768px이며, 2K가 아닙니다. 2K는 두 번째 인컨텍스트 재생성 패스를 통해 생성됩니다.
  • 상업적 사용은 무료이지만 UI에 "MiniMax H3"를 표시해야 하며, 연간 수익이 2000만 달러를 초과하면 별도의 서면 승인이 필요합니다. 그리고 라이선스의 적용 지역은 EU, 영국, 한국, 미국을 제외합니다. 호스팅 API는 별도의 법적 관계입니다.

한 캐릭터, 두 체크포인트, 새벽 3시. 왼쪽은 fl2va가 하는 작업, 오른쪽은 ref2va가 하는 작업입니다. 같은 사람, 같은 방, 같은 밤, 완전히 다른 두 작업, 그리고 들리는 팬 소음은 그림과 동일한 패스에서 생성됩니다.

듀얼 모니터 책상에서 작업하는 남성의 나란히 비교

왼쪽: 이미지-투-비디오, fl2va 체크포인트가 수행하는 작업. 오른쪽: 참조-투-비디오, ref2va가 수행하는 작업. 둘 다 MiniMax H3에서 네이티브 스테레오 오디오로 렌더링됨. 소리를 켜세요.

이 모델에 처음으로 생성하라고 요청한 것은 이 모델이 다운로드를 완료하기를 기다리는 인간이었습니다. 적절한 선택이었죠.

MiniMax H3 오픈 소스 가중치, 무게를 재다: 두 체크포인트와 42.5GB 바닥

이번 출시가 왜 큰 반향을 일으켰는지 설명하자면, Artificial Analysis는 H3를 비디오 편집 분야 1위, 텍스트-투-비디오와 이미지-투-비디오 모두에서 상위 3위로 평가했으며, 가중치 공개는 "지금까지 가장 앞선 오픈 가중치 모델이 될 것"이라고 밝혔습니다(Artificial Analysis, 2026년 7월). 이는 다운로드 버튼이 있는 프론티어급 비디오 모델입니다.

솔직한 다른 측면: 동일한 벤치마크에서 H3는 텍스트-투-비디오에서 Google의 Gemini Omni Flash에 뒤지고, 이미지-투-비디오에서는 Seedance 2.0과 Gemini Omni Flash 모두에 뒤집니다(South China Morning Post, 2026년 7월). 편집 분야에서 1위이지 모든 분야에서 1위는 아닙니다.

이제 git clone을 누르기 전에 거의 아무도 확인하지 않은 부분입니다.

어느 헤드라인에도 등장하지 않은 파라미터 수. 모델 카드는 H3-Omni-Transformer를 "약 13B 파라미터가 AdaLN 관련 브랜치에 있는 33B-파라미터 밀집 단일 스트림 Transformer"로 설명하며, 이러한 변조 출력을 사전 계산 및 캐시할 수 있기 때문에 "추론 전용 배포에서는 이러한 파라미터를 로드할 필요가 없습니다."라고 덧붙입니다. 여기서 가지치기된 체크포인트가 나옵니다. 모델의 약 40%가 추론 전용일 때 조회 테이블로 변환됩니다.

대부분이 80GB를 헛되이 소모하는 곳. 공식 MiniMaxAI/MiniMax-H3 저장소는 전체를 가져오면 498GB입니다. ComfyUI 미러는 343GB입니다. 둘 다 두 체크포인트의 모든 정밀도 변형을 보관합니다. 필요한 파일은 400개가 아니라 4개입니다.

파일크기설명필요한 경우
minimax_h3_fl2va_pruned_int8_convrot.safetensors20.97 GBfl2va 체크포인트, 가지치기 + int8텍스트-투-비디오, 이미지-투-비디오
minimax_h3_fl2va_int8_convrot.safetensors34.04 GBfl2va, int8, 가지치기 안 됨동일, 더 높은 선명도
minimax_h3_fl2va_bf16.safetensors66.28 GBfl2va, 전체 정밀도미세 조정, 연구
minimax_h3_ref2va_pruned_int8_convrot.safetensors20.97 GBref2va 체크포인트, 가지치기 + int8참조-투-비디오 전용
minimax_h3_ref2va_int8_convrot.safetensors34.04 GBref2va, int8, 가지치기 안 됨동일, 더 높은 선명도
minimax_h3_ref2va_bf16.safetensors66.28 GBref2va, 전체 정밀도미세 조정, 연구
qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors15.69 GB텍스트 인코더, 4비트 AWQ모든 워크플로우
qwen3vl_32b_minimax_h3_int8_convrot.safetensors27.14 GB텍스트 인코더, int8모든 워크플로우
qwen3vl_32b_minimax_h3_bf16.safetensors51.51 GB텍스트 인코더, 전체 정밀도모든 워크플로우
minimax_h3_video_vae_fp16.safetensors5.21 GB비디오 VAE모든 워크플로우
minimax_h3_audio_vae_fp32.safetensors0.61 GB오디오 VAE모든 워크플로우 (이것이 소리입니다)
한 작업에 대한 최소 작업 세트42.5 GB가지치기 fl2va + nvfp4 인코더 + 두 VAE현실적인 다운로드
두 체크포인트, 최소63.4 GB가지치기 ref2va 추가세 가지 모드 모두 원할 경우
한 작업 전체 bf16123.6 GBbf16 모두연구용 장비 전용

파일 크기는 Comfy-Org/MiniMax-H3 저장소 인덱스에서 직접 읽어옴, 2026년 8월.

ComfyUI의 동일 수치에 대한 자체 설명: "전체 메모리 사용량이 전체 정밀도 123.6GB에서 42.5GB로 66% 감소하여, '차세대 2K 비디오 모델을 RTX 3060과 같은 GPU에서 로컬로 실행할 수 있게 합니다.'"(ComfyUI, 2026년 8월). 12GB 수치는 동적 오프로딩을 포함한 그들의 주장이며, 벤치마크가 아닙니다. 저는 3060에서 실행해보지 않았고, 오프로딩은 VRAM을 시스템 RAM과 벽시계 시간으로 대체합니다.

"로컬에서 실행"이라는 말이 조용히 의미하는 것: 768px. H3의 네이티브 캔버스는 768px 짧은 쪽이며, ComfyUI의 H3 튜토리얼에 따르면 768x1344로 제한됩니다. 길이는 24fps에서 17프레임 블록 단위로 맞춰집니다. 마케팅 자료의 2K 클립은 H3-Regenerate-2K라는 두 번째 패스에서 나오며, 768p 결과와 원본 컨텍스트를 다시 모델에 입력합니다. 모델 카드는 전체 시스템이 H3-Context-IR, H3-Base, H3-Regenerate-2K의 세 가지 모듈로 구성되어 있다고 명시합니다. 로컬 ComfyUI는 H3-Base를 제공합니다.

그리고 "오픈"이라는 단어는 여기서 세 가지 다른 역할을 합니다. 다운로드 가능, 예. 상업적 사용 가능, 조건부. 거주 지역에서 실행 가능, 그건 거주 지역에 따라 다릅니다. 이걸 "실제로는 클로즈드 소스 모델"이라고 부르는 레딧 스레드는 첫 번째 지점에서 틀렸고, 나머지 두 지점에서는 실제 문제를 지적하고 있습니다. 섹션 7에 조항 텍스트가 있습니다.

로컬 MiniMax H3 오픈 소스 가중치 vs 호스팅 API: 경로 선택

이 줄 아래의 모든 내용, 전체 4단계 데모는 Atlas Cloud의 한 브라우저 탭에서 실행됩니다. 이는 모든 H3 엔드포인트와 베이스 프레임에 사용한 이미지 모델을 제공합니다. 이는 가중치를 실행하는 것과 동일하지 않으며, 그 차이는 이 모델에서 평소보다 더 중요합니다.

로컬 가중치호스팅 API
선행 비용42.5GB 다운로드, 12GB+ GPU, ComfyUI 설치API 키
첫 클립까지 시간낙관적으로 저녁 한 끼약 2분
5초 클립당 비용GPU 시간 및 전기료0.70달러 (0.14달러/초)
네이티브 해상도768px 짧은 쪽, 2K는 재생성 패스 필요2K 직접, 유일한 열거형 값
미세 조정, LoRA, 수술가능, 그것이 핵심불가능
데이터가 네트워크를 떠나지 않음가능불가능
라이선스 노출커뮤니티 라이선스 및 지역 조항 수락호스팅 서비스의 고객
EU, 영국, 한국, 미국 거주 시섹션 7가중치 라이선스의 영향을 받지 않음

경험 법칙: 월 약 100개 클립 미만이거나, 2K가 바로 필요하거나, 제외 지역에 거주하는 경우, 호스팅이 모든 측면에서 유리합니다. 그 이상이거나, 체크포인트 위에서 훈련하려 하거나, 영상이 건물을 떠날 수 없는 경우, 42.5GB는 저녁 한 끼 투자할 가치가 있습니다.

가격은 2026년 8월 기준 라이브 모델 페이지에서 확인했습니다. 모든 H3 엔드포인트는 출력 1초당 청구되며, 활성 할인은 없습니다.

모델여기서 하는 작업가격할인
MiniMax H3 image-to-video2단계, fl2va 작업2K 기준 0.14달러/초없음
MiniMax H3 reference-to-video3단계, ref2va 작업2K 기준 0.14달러/초없음
MiniMax H3 text-to-video4단계, 참조 없는 베이스라인2K 기준 0.14달러/초없음
GPT Image 2 text-to-image1단계, 베이스 프레임나열된 가격 0.009달러/이미지; 제가 사용한 고품질 16:9 실행은 0.1745달러없음
Seedance 2.0 / Wan 2.7 / Kling v3.0 Turbo초당 참조 포인트0.112 / 0.10 / 0.095달러/초Kling 15% 할인

코드로 작성하기 전에 알아야 할 불일치 사항: H3 README에는 여전히 0.10달러/초의 768p 등급과 5초 또는 10초 길이가 문서화되어 있습니다. 라이브 스키마는 다릅니다. resolution에는 정확히 하나의 허용 값인 2K가 있으며, duration은 5에서 15 사이의 정수를 허용합니다. 스키마를 기준으로 작성하세요. 그 간격에는 깔끔한 대칭이 있습니다. 768p 등급은 호스팅 측에서 꺼져 있으며, 768p는 바로 가중치를 직접 실행할 때 얻는 네이티브 캔버스입니다.

1단계: GPT Image 2로 베이스 프레임 생성

이 데모의 모든 것은 하나의 정지 이미지에서 시작됩니다. 장면은 의도적으로 직설적입니다: 새벽 3시에 21GB 체크포인트 다운로드를 지켜보는 개발자.

모델: openai/gpt-image-2/text-to-image. 설정: 품질 high, 비율 16:9.

plaintext
1A photorealistic wide shot of a cluttered home office at 3 a.m., lit only by two monitors and the RGB glow from an open PC case on the desk. A tired developer in a gray hoodie sits slouched in a mesh chair, chin on hand, staring at the left monitor. The left monitor shows a dark terminal with a single visible download progress bar at about 78 percent. The right monitor shows a file browser. A cold half-full mug of coffee, a mechanical keyboard, and a small desk fan sit on the desk. Rain streaks the window behind him. Shallow depth of field, 35mm, warm monitor key light against cool blue window light, visible sensor grain. No text overlays, no watermarks.
2

이미지 모델에 실제 safetensors 파일 이름을 렌더링하도록 요청하지 마세요. 긴 밑줄 문자열은 흐릿하게 나옵니다. 캡션에는 파일 이름을 포함하지 마세요.

출력이 포함된 Atlas Cloud 텍스트-투-이미지 생성기 인터페이스 스크린샷

Atlas Cloud의 GPT Image 2 플레이그라운드, 입력된 새벽 3시 프롬프트와 출력 패널의 완성된 베이스 프레임

Atlas Cloud의 GPT Image 2: 고품질, 16:9, 오른쪽에 렌더링된 베이스 프레임. 고품질 등급은 이 실행에 대해 0.1745달러를 청구하며, 이는 0.009달러 목록 바닥보다 훨씬 높으므로 등급별로 예산을 세우세요.

밤에 듀얼 컴퓨터 모니터를 바라보는 후드티를 입은 남성

생성된 베이스 프레임: 새벽 3시에 왼쪽 모니터의 다운로드 바를 지켜보는 피곤한 개발자

1단계 출력. 이 단일 프레임은 2단계와 3단계에 입력됩니다.

2단계: 이미지-투-비디오, fl2va 체크포인트가 수행하는 작업

이 엔드포인트는 minimax_h3_fl2va_pruned_int8_convrot.safetensors에 해당합니다. 첫 번째 프레임 입력, 모션과 사운드 출력. 로컬에서는 이 파일을 로드하고, 호스팅에서는 하나의 API 호출입니다.

모델: minimax/h3/image-to-video. 설정: image = 1단계 프레임을 데이터 URL로 전달, resolution: 2K, duration: 5, ratio: 16:9.

plaintext
1The developer stays still, only breathing and blinking, eyes fixed on the left monitor. The progress bar on the left monitor creeps forward. The case fans spool up and their RGB glow pulses brighter. A moment before the end he exhales and his shoulders drop. Locked-off camera, no camera movement, no zoom, no cuts. Audio: a low case-fan whine that rises in pitch, faint rain against the window, one soft two-note completion chime near the end.
2

이미지를 갓 생성된 스토리지 URL 대신 base64 데이터 URL로 전달하세요. 새 개체 URL은 업스트림 다운로드 확인에 실패할 수 있습니다. 또한 H3는 "고정 카메라"를 실제로 따르며, 이는 이 클래스의 비디오 모델에서 보편적으로 사실이 아닙니다.

MiniMax 이미지-투-비디오 생성기 인터페이스 스크린샷

Atlas Cloud의 MiniMax H3 이미지-투-비디오 플레이그라운드, 로드된 베이스 프레임과 출력 패널의 완성된 2K 클립

MiniMax H3 이미지-투-비디오: 베이스 프레임 로드, 2K, 실행 완료. 이 캡처는 엔드포인트 기본값인 8초를 사용했으며, 따라서 견적이 1.12달러로 표시됩니다. 아래 포함된 클립은 0.70달러의 5초 버전입니다.

밤에 컴퓨터 로딩 바를 기다리는 피곤한 남성

fl2va 작업: 하나의 프레임 입력, 5초의 모션과 스테레오 팬 소음 출력.

3단계: 참조-투-비디오, ref2va 체크포인트가 수행하는 작업

다른 체크포인트, 다른 파일, 다른 작업. ref2va는 첫 번째 프레임을 확장하지 않습니다. 참조 자료를 가져와 정체성과 객체 일관성을 유지하는 새로운 샷을 구축합니다. 이것이 저장소가 하나 대신 두 개의 21GB 파일을 제공하는 이유입니다.

두 가지 참조를 제공했습니다: 사람과 방을 위한 1단계 프레임, 하드웨어를 위한 그래픽 카드의 매크로 샷.

모델: minimax/h3/reference-to-video. 설정: refers = 두 이미지, resolution: 2K, duration: 8, ratio: 16:9.

plaintext
1Same man, same gray hoodie, same face, in the same dark home office. New shot: a medium close-up from the side as he leans back in the chair and lets out a long breath, the corner of his mouth lifting slightly. The graphics card in the second reference image is visible over his shoulder, its fans slowing down, RGB settling to a steady color. Keep his identity, hoodie, hair and the room's lighting consistent with the reference images. Locked-off camera. Audio: fan whine winding down, one keyboard keypress, rain continuing.
2

refers는 이미지, 비디오 및 오디오의 혼합 배열을 받으며, 최소 하나의 이미지 또는 비디오가 필요합니다. 오디오 단독은 거부됩니다. 이 엔드포인트는 최대 15초까지 길이를 허용합니다.

이 엔드포인트의 특별한 함정: ratio를 명시적으로 설정하세요. adaptive로 두면 400 invalid params, ratio is required for t2va (text-only) and cannot be 'adaptive'가 4번 연속으로 반환되었으며, 두 참조가 명확히 첨부된 플레이그라운드에서도 마찬가지였습니다. API 호출에 ratio: "16:9"를 포함하면 첫 번째 시도에 실행되었습니다. 따라서 아래 스크린샷이 플레이그라운드 캡처 대신 참조 이미지인 이유이기도 합니다. 플레이그라운드의 종횡비 컨트롤을 adaptive에서 변경할 수 없었기 때문에, 여기 보이는 클립은 위 설정으로 API에서 직접 가져온 것이며, 플레이그라운드 실행이 아닙니다.

컴퓨터 케이스 내부에 수직으로 장착된 트리플 팬 그래픽 카드

두 번째 참조 이미지: 밤에 열린 PC 케이스 내부의 트리플 팬 그래픽 카드 매크로 샷

참조 이미지 2, 베이스 프레임과 동일한 배치로 생성, 1단계 프레임과 함께 전달.

밤에 듀얼 모니터 책상에서 타이핑하는 남성

ref2va 작업: 연속이 아닌 새로운 시점. 같은 남성, 같은 후드티, 같은 방, 그리고 참조 2의 그래픽 카드가 팬을 줄이며 프레임에 나타납니다. "미디엄 클로즈업"을 느슨하게 해석하여 상당히 와이드하게 유지되었습니다.

4단계: 텍스트-투-비디오, MiniMax H3 오픈 소스 가중치 베이스라인

동일한 장면을 단어로 설명, 참조 없음. 이 단계는 두 체크포인트가 실제로 무엇을 위한 것인지 보여주기 위해 존재합니다.

모델: minimax/h3/text-to-video. 설정: ratio필수이며 adaptive가 될 수 없으므로 16:9. resolution: 2K, duration: 5.

plaintext
1A tired developer in a gray hoodie at 3 a.m. in a cluttered home office, lit by two monitors and the RGB glow of an open PC case, watching a download progress bar crawl across the left screen. Rain on the window behind him. Locked-off 35mm shot, shallow depth of field, warm monitor light against cool window light, film grain. Audio: rising case-fan whine, faint rain, a soft completion chime at the end.
2

프롬프트와 생성된 비디오 출력을 보여주는 AI 텍스트-투-비디오 인터페이스

Atlas Cloud의 MiniMax H3 텍스트-투-비디오 플레이그라운드, 입력된 프롬프트와 출력 패널의 완성된 클립

MiniMax H3 텍스트-투-비디오: 참조 자료 없음, 2K, 여기서 adaptive가 거부되므로 종횡비를 16:9로 설정, 실행 완료. 동일한 프롬프트, 이미 2단계의 얼굴과 다른 얼굴.

밤에 컴퓨터 화면을 바라보는 회색 후드티 남성

같은 단어, 다른 인간. 좋은 방, 잘못된 사람. 그 차이가 fl2varef2va가 별도의 체크포인트로 존재하는 전체 이유입니다.

세 가지를 모두 스크립트로 작성하는 경우 한 가지 운영상의 주의사항: 업스트림 동시성은 대략 하나의 작업입니다. 겹치는 작업은 429 rate limit exceeded (task concurrency)로 반환됩니다. 순차적으로 실행하세요. 5초 2K 클립은 각각 약 2분이 걸렸습니다.

MiniMax H3 오픈 소스 가중치 비용, 그리고 라이선스가 실제로 말하는 것

비용 질문에는 두 가지 통화가 있습니다. 호스팅에서 5초 2K 클립은 0.70달러, 15초는 2.10달러로, 초당, 등급 없음, 할인 없음입니다. 로컬에서 통화는 기가바이트와 시간입니다: 42.5GB 다운로드, 이를 담을 수 있는 카드, 그리고 재생성 패스도 실행하지 않는 한 768p 캔버스. 월 수백 개 클립을 넘어서면 산술이 뒤집힙니다. 그 이하에서는 대부분 그렇지 않습니다.

그리고 세 번째 통화인 법적 검토 시간이 있습니다. 전체 LICENSE를 읽었습니다. 그 내용은 다음과 같습니다.

책상 램프 아래 열린 노트북과 서류 더미

빽빽한 텍스트 문서를 보여주는 노트북을 비추는 책상 램프, 강조 표시된 인쇄물, 독서용 안경, 물 한 잔

출시 스레드에서 아무도 스크린샷을 찍지 않는 오픈 가중치 릴리스의 일부.

조항섹션내용사용자에게 의미
적용 지역I.3, I.5전 세계, "제외 지역" 제외, "유럽연합, 영국, 대한민국, 미국"으로 정의됨커뮤니티 라이선스는 이 기사 독자 대부분이 사는 곳에서 권리를 부여하지 않음
지역 사용 금지V.4"적용 지역 외부에서 MiniMax H3 저작물 또는 그 출력물이나 결과물을 사용, 복제, 수정, 배포 또는 전시할 수 없음"가중치뿐만 아니라 출력물에도 적용됨
별도 라이선스 채널IIMiniMax는 "해당 법률을 지속적으로 평가"하며, 제외 지역의 당사자에게 라이선스 문의를 초대함"영원히 불가"가 아닌 "아직 아님." 저장소에 신청 양식이 있음
저작자 표시IV.2상업 제품 사용 시 "사용자 인터페이스에 'MiniMax H3'를 눈에 띄게 표시해야 함"각주가 아닌 UI 변경
수익 임계값IV.1연간 수익이 2000만 달러를 초과하는 경우 [email protected]로 사전 서면 승인 필요무료 상업 사용에는 상한선이 있음
모델 세탁 금지V.3H3 또는 그 출력물을 "다른 인공지능 모델을 개선하는 데 사용할 수 없음"자체 모델로의 증류(distillation) 금지
재배포III.1, III.4계약서 함께 제공, NOTICE 파일 포함, 수정된 파일 표시표준이지만 하위 사용자도 구속함
텍스트 인코더추가 참고인코더는 Apache 2.0의 Qwen3-VL-32B스택의 한 구성 요소는 진정한 OSI 오픈
준거법IX홍콩 특별행정구 법률, 홍콩 전속 관할권위험 등록부에 한 줄 추가할 가치 있음

계약의 발효일은 2026년 8월 2일입니다(Hugging Face, 2026년 8월).

대부분의 출시 보도는 "오픈 가중치"로 시작하고 거기서 멈췄습니다. MiniMax의 공로로, 그들은 숨기지 않았습니다. 저장소에는 비디오 모델이 텍스트 모델보다 더 빠르게 움직이는 규제 환경에 직면해 있다는 점, EU AI Act, 영국 및 한국 규칙, 생성 비디오에 대한 진행 중인 미국 저작권 소송을 언급하고, "현재 제한은 '영원히 불가'가 아니라 '아직 아님'을 의미한다"고 명시하는 자체 docs/QA-about-License.md 문서가 포함되어 있습니다. 동일 문서는 운영상 중요한 분할을 확인합니다. MiniMax가 서빙 인프라를 통제하기 때문에 API는 전 세계적으로 사용 가능한 상태로 유지되는 반면, 오픈 가중치는 그 통제를 뒤에 남깁니다.

따라서 샌프란시스코, 베를린, 런던 또는 서울에 있다면, 실제 해석은 "H3를 절대 만질 수 없다"가 아닙니다. "이 특정 라이선스는 자체 박스에서 가중치를 실행할 수 있게 해주는 도구가 아니다"입니다. 별도 라이선스를 신청하거나, 호스팅 엔드포인트를 사용하세요. 그러면 가중치의 라이선스 사용자가 아닌 서비스 고객이 됩니다.

저는 변호사가 아니며 이는 법적 조언이 아닙니다. 위 조항 텍스트는 인용된 것이므로, 실제 법률 고문이 약 10분 만에 원본을 읽을 수 있습니다.

MiniMax H3 오픈 소스 가중치: 자주 묻는 질문

MiniMax H3 오픈 소스 가중치가 실제로 출시되었으며, 어디서 다운로드하나요?

네, 2026년 8월 초 기준으로 출시되었습니다. 두 곳입니다. MiniMaxAI/MiniMax-H3는 공식 저장소로 약 498GB이며, diffusers 형식 파이프라인, 두 트랜스포머, 텍스트 인코더, 두 VAE, 문서, 재현 가능한 스크립트를 포함합니다. Comfy-Org/MiniMax-H3는 재패키징된 ComfyUI 빌드로 약 343GB이며, 대부분이 원하는 양자화된 단일 파일 체크포인트를 포함합니다. ComfyUI를 실행 중이라면 두 번째를 사용하고 네 개의 파일을 다운로드하세요.

MiniMax H3의 파라미터 수는 얼마이며, 슈퍼컴퓨터가 필요한가요?

33B, 밀집 단일 스트림 Transformer입니다. 약 13B는 AdaLN 관련 브랜치에 있으며, 그 출력을 사전 계산 및 캐시할 수 있으므로 추론 전용 배포에서는 로드할 필요가 없습니다. 이것이 "가지치기" 체크포인트의 의미입니다. 슈퍼컴퓨터는 필요 없습니다. 42.5GB 다운로드와 일반적인 소비자 GPU로 충분합니다.

MiniMax H3 오픈 소스 가중치를 12GB 또는 16GB VRAM에서 실행할 수 있나요?

ComfyUI 팀은 동적 오프로딩을 사용하여 가지치기된 int8 fl2va 체크포인트와 nvfp4 AWQ 텍스트 인코더로 12GB 카드에서 실행할 수 있다고 말합니다. 이는 제가 실행한 벤치마크가 아닌 그들의 주장입니다. 두 가지 주의사항: 오프로딩은 VRAM을 시스템 RAM으로 대체하므로 64GB RAM을 예산에 포함하고 긴 렌더 시간을 예상해야 하며, 로컬 캔버스는 768px 짧은 쪽이지 2K가 아닙니다.

MiniMax H3 오픈 소스 가중치는 정말 오픈 소스인가요, 아니면 그냥 오픈 가중치인가요?

정확히는 오픈 가중치입니다. 가중치는 다운로드 및 수정 가능하며, 이는 1년 전에 어떤 프론티어 비디오 모델도 제공하지 않은 것입니다. 그러나 라이선스는 OSI 승인을 받지 않았고, 훈련 레시피와 데이터는 공개되지 않았으며, 상업적 사용에는 저작자 표시 및 수익 조건이 있고, 지역 조항은 승인이 적용되는 곳을 제한합니다. 진정한 오픈 구성 요소는 Apache 2.0의 Qwen3-VL-32B 인코더입니다. 세 개의 별도 계층이며, "오픈"은 첫 번째 계층만 깔끔하게 설명합니다.

MiniMax H3 오픈 소스 가중치를 상업적으로 사용할 수 있나요? 2000만 달러 조건은 무엇인가요?

네, 두 가지 조건이 있습니다. 상업 제품의 사용자 인터페이스에 "MiniMax H3"를 눈에 띄게 표시해야 합니다(섹션 IV.2). 그리고 상업 제품 및 서비스의 연간 수익이 2000만 달러를 초과하는 경우, 사용 전에 MiniMax로부터 별도의 사전 서면 승인이 필요하며, [email protected]로 요청합니다(섹션 IV.1). 임계값은 H3 사용량이 아닌 사용자의 수익에 적용됩니다.

MiniMax H3 라이선스가 미국과 EU를 제외하는 이유는 무엇이며, 대안은 무엇인가요?

MiniMax 자체 라이선스 Q&A에 따르면, 비디오 생성이 텍스트보다 더 빠르게 움직이는 규제 환경, 특히 EU AI Act, 진화하는 영국 및 한국 규칙, 생성 비디오에 대한 진행 중인 미국 저작권 소송에 직면해 있기 때문입니다. 가중치가 공개되면 하위에서 규제를 적용할 수 없으므로, 출시를 지연하는 대신 승인 범위를 조정했습니다. 제외 지역에서의 대안: 저장소의 양식을 통해 별도 라이선스를 신청하거나, 호스팅 API를 사용하세요. 이는 다른 법적 관계이며 전 세계적으로 사용 가능합니다. 배포 전에 법률 고문이 적합한지 확인하세요.


2026년 8월 3일 확인. 후속 목록의 세 가지: 커뮤니티 GGUF 및 더 낮은 비트 양자화 (H3에는 아직 없음), 제외 지역 목록의 변경 사항, README에 여전히 문서화된 호스팅 768p 등급이 다시 돌아오는지 여부.

최신 모델

하나의 API로 모든 미디어 AI를.

모든 모델 탐색