Chạy HunyuanImage 3.0 ngay trong ComfyUI với GPU từ 12 GB
ComfyUI-HunyuanImage3 giúp tạo ảnh, chỉnh sửa và kết hợp nhiều ảnh bằng HunyuanImage 3.0 ngay trong workflow ComfyUI. Phù hợp với người đã quen ComfyUI, có GPU NVIDIA từ 12 GB và máy dư nhiều RAM.
Vì sao đáng xem
- Chạy trực tiếp với KSampler, VAE Decode và cơ chế quản lý bộ nhớ của ComfyUI
- Hỗ trợ tạo ảnh từ văn bản, chỉnh sửa ảnh và kết hợp tối đa ba ảnh
- Bản Instruct-Distil W4A8 chỉ cần 8 bước và được tác giả khuyên dùng để bắt đầu
- Có workflow mẫu và nhiều mức trọng số để lựa chọn theo nhu cầu
ComfyUI-HunyuanImage3 là bộ custom node đưa HunyuanImage 3.0 của Tencent vào ComfyUI. Bạn có thể dùng model để tạo ảnh từ câu lệnh, chỉnh sửa ảnh có sẵn hoặc ghép nội dung từ nhiều ảnh mà không phải rời khỏi workflow quen thuộc.
Điểm đáng chú ý là dự án dùng KSampler, VAE Decode và cơ chế quản lý bộ nhớ sẵn có của ComfyUI. Model có tổng cộng 80 tỷ tham số nhưng chỉ kích hoạt một phần ở mỗi bước. Các trọng số còn lại được truyền từ RAM hệ thống, nhờ vậy bản W4A8 có thể chạy trên một GPU NVIDIA từ 12 GB VRAM. Đổi lại, cấu hình máy phải có nhiều RAM và ổ SSD đủ nhanh.

Ảnh từ nguồn chính thức của HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image.
Bạn có thể dùng nó vào việc gì?
Tạo ảnh ngay trong workflow ComfyUI
Bản Instruct-Distil là lựa chọn dễ bắt đầu nhất. Model chạy 8 bước, hỗ trợ prompt thông thường và có sẵn workflow mẫu. Trong phép đo của tác giả trên RTX 4090, một ảnh 1024 x 1024 sau khi model đã được nạp mất khoảng 26 giây với W4A8. Đây là số liệu tham khảo, không phải tốc độ bảo đảm cho mọi máy.
Chỉnh sửa ảnh bằng câu lệnh
Bạn có thể đưa ảnh vào node Image Encode rồi mô tả thay đổi, chẳng hạn chuyển ảnh thành tranh màu nước, thay bối cảnh hoặc điều chỉnh phong cách. Workflow này phù hợp khi muốn thử nhiều biến thể mà không phải dựng lại toàn bộ chuỗi node.
Kết hợp nội dung từ nhiều ảnh
Công cụ nhận tối đa ba ảnh đầu vào. Bạn có thể yêu cầu lấy nhân vật từ ảnh thứ nhất và đặt vào không gian của ảnh thứ hai, hoặc dùng một ảnh làm nội dung và ảnh khác làm tham chiếu phong cách. Mỗi ảnh bổ sung sẽ làm thời gian xử lý tăng lên.
Mở rộng prompt ngắn
Node Prompt Rewriting có thể biến mô tả ngắn thành prompt chi tiết trước khi tạo ảnh. Tính năng này đọc được cả ảnh đầu vào khi chỉnh sửa, nhưng khá chậm: tài liệu cho biết một lần viết lại khoảng 300 token có thể mất 4 đến 5 phút.

Ảnh từ nguồn chính thức của HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image.
Cần lưu ý
Đây không phải lựa chọn nhẹ. Riêng tệp W4A8 được khuyên dùng đã khoảng 44 GB, ComfyUI có thể chiếm khoảng 50 GB RAM hệ thống khi chạy. Bản int8 và bf16 còn lớn và chậm hơn. GPU 12 GB hoặc 16 GB vẫn chạy được Instruct-Distil W4A8, nhưng máy vẫn cần lượng RAM tương tự bản 24 GB.
Dự án cũng yêu cầu phiên bản ComfyUI tương đối mới và thiết lập đúng sampler, scheduler cùng các tệp model. Các workflow có sẵn giúp giảm công cấu hình, nhưng người mới hoàn toàn với ComfyUI có thể vẫn cần thời gian làm quen.
Nếu cấu hình đáp ứng được yêu cầu và bạn muốn thử HunyuanImage 3.0 mà vẫn giữ workflow node hiện tại, hãy xem repository, ảnh so sánh và hướng dẫn cài đặt trước khi tải bộ trọng số dung lượng lớn.
Muốn tự kiểm tra và dùng thử?
Mở nguồn gốc để xem tài liệu, cách cài đặt và phiên bản mới nhất.
Điểm cần lưu ý
- • Cần GPU NVIDIA từ 12 GB VRAM, khoảng 50 GB RAM trống và SSD nhanh
- • Tệp W4A8 được khuyên dùng vẫn có dung lượng khoảng 44 GB
- • Số liệu tốc độ trong tài liệu được đo chủ yếu trên RTX 4090 nên máy khác có thể chậm hơn đáng kể
Đọc tiếp
Có thể bạn sẽ cần những thứ này tiếp theo
AI video
OBVPM Timeline: dựng và kéo dài video MiniMax H3 ngay trong ComfyUI
Một bộ node và workflow biến ComfyUI thành trình dựng video thu nhỏ, giúp bạn sắp xếp, nối dài, chèn lại và hoàn thiện các clip MiniMax H3 trên cùng một timeline. Phù hợp với người đã quen ComfyUI và muốn làm video dài hơn mà vẫn kiểm soát được các điểm nối.
Xem tiếpAI Tools
Qwen-Image-2.1: AI ảnh 7B chạy local, benchmark nhỉnh Nano Banana Pro, không tốn credit từng lượt
Tải weights về tự chạy bằng ComfyUI hoặc Diffusers. Không quota theo lượt từ nền tảng, không trả credit/API cho mỗi lần tạo ảnh; nếu đã có phần cứng, chi phí trực tiếp chủ yếu là điện.
Xem tiếpNguồn tham khảo
Link ngoài và tài liệu liên quan
- Nguồn Chính
- Nguồn