Hình minh họa chính thức của HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image
AI tạo ảnh Tuyển chọn

Chạy HunyuanImage 3.0 ngay trong ComfyUI với GPU từ 12 GB

ComfyUI-HunyuanImage3 giúp tạo ảnh, chỉnh sửa và kết hợp nhiều ảnh bằng HunyuanImage 3.0 ngay trong workflow ComfyUI. Phù hợp với người đã quen ComfyUI, có GPU NVIDIA từ 12 GB và máy dư nhiều RAM.

ComfyUIHunyuanImage 3.0AI tạo ảnhimage editingcustom node
-

Vì sao đáng xem

  • Chạy trực tiếp với KSampler, VAE Decode và cơ chế quản lý bộ nhớ của ComfyUI
  • Hỗ trợ tạo ảnh từ văn bản, chỉnh sửa ảnh và kết hợp tối đa ba ảnh
  • Bản Instruct-Distil W4A8 chỉ cần 8 bước và được tác giả khuyên dùng để bắt đầu
  • Có workflow mẫu và nhiều mức trọng số để lựa chọn theo nhu cầu

ComfyUI-HunyuanImage3 là bộ custom node đưa HunyuanImage 3.0 của Tencent vào ComfyUI. Bạn có thể dùng model để tạo ảnh từ câu lệnh, chỉnh sửa ảnh có sẵn hoặc ghép nội dung từ nhiều ảnh mà không phải rời khỏi workflow quen thuộc.

Điểm đáng chú ý là dự án dùng KSampler, VAE Decode và cơ chế quản lý bộ nhớ sẵn có của ComfyUI. Model có tổng cộng 80 tỷ tham số nhưng chỉ kích hoạt một phần ở mỗi bước. Các trọng số còn lại được truyền từ RAM hệ thống, nhờ vậy bản W4A8 có thể chạy trên một GPU NVIDIA từ 12 GB VRAM. Đổi lại, cấu hình máy phải có nhiều RAM và ổ SSD đủ nhanh.

Ảnh giao diện hoặc minh họa chính thức của HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image

Ảnh từ nguồn chính thức của HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image.

Bạn có thể dùng nó vào việc gì?

Tạo ảnh ngay trong workflow ComfyUI

Bản Instruct-Distil là lựa chọn dễ bắt đầu nhất. Model chạy 8 bước, hỗ trợ prompt thông thường và có sẵn workflow mẫu. Trong phép đo của tác giả trên RTX 4090, một ảnh 1024 x 1024 sau khi model đã được nạp mất khoảng 26 giây với W4A8. Đây là số liệu tham khảo, không phải tốc độ bảo đảm cho mọi máy.

Chỉnh sửa ảnh bằng câu lệnh

Bạn có thể đưa ảnh vào node Image Encode rồi mô tả thay đổi, chẳng hạn chuyển ảnh thành tranh màu nước, thay bối cảnh hoặc điều chỉnh phong cách. Workflow này phù hợp khi muốn thử nhiều biến thể mà không phải dựng lại toàn bộ chuỗi node.

Kết hợp nội dung từ nhiều ảnh

Công cụ nhận tối đa ba ảnh đầu vào. Bạn có thể yêu cầu lấy nhân vật từ ảnh thứ nhất và đặt vào không gian của ảnh thứ hai, hoặc dùng một ảnh làm nội dung và ảnh khác làm tham chiếu phong cách. Mỗi ảnh bổ sung sẽ làm thời gian xử lý tăng lên.

Mở rộng prompt ngắn

Node Prompt Rewriting có thể biến mô tả ngắn thành prompt chi tiết trước khi tạo ảnh. Tính năng này đọc được cả ảnh đầu vào khi chỉnh sửa, nhưng khá chậm: tài liệu cho biết một lần viết lại khoảng 300 token có thể mất 4 đến 5 phút.

Ảnh giao diện hoặc minh họa chính thức của HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image

Ảnh từ nguồn chính thức của HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image.

Cần lưu ý

Đây không phải lựa chọn nhẹ. Riêng tệp W4A8 được khuyên dùng đã khoảng 44 GB, ComfyUI có thể chiếm khoảng 50 GB RAM hệ thống khi chạy. Bản int8 và bf16 còn lớn và chậm hơn. GPU 12 GB hoặc 16 GB vẫn chạy được Instruct-Distil W4A8, nhưng máy vẫn cần lượng RAM tương tự bản 24 GB.

Dự án cũng yêu cầu phiên bản ComfyUI tương đối mới và thiết lập đúng sampler, scheduler cùng các tệp model. Các workflow có sẵn giúp giảm công cấu hình, nhưng người mới hoàn toàn với ComfyUI có thể vẫn cần thời gian làm quen.

Nếu cấu hình đáp ứng được yêu cầu và bạn muốn thử HunyuanImage 3.0 mà vẫn giữ workflow node hiện tại, hãy xem repository, ảnh so sánh và hướng dẫn cài đặt trước khi tải bộ trọng số dung lượng lớn.

Muốn tự kiểm tra và dùng thử?

Mở nguồn gốc để xem tài liệu, cách cài đặt và phiên bản mới nhất.

Access Gate

0/1 bước

Hoàn thành 1 bước để tiếp tục

Chạy HunyuanImage 3.0 ngay trong ComfyUI với GPU từ 12 GB

Direct sponsor Chưa hoàn thành

Mở trang nhà tài trợ

Đây là liên kết nhà tài trợ/cross-promo độc lập, không phải quảng cáo CPC bắt buộc click.

Shopee · Tài trợ

Mở tab nhà tài trợ

Prototype hiện ghi proof trên trình duyệt. Production sẽ xác minh bằng Worker/server.

Điểm cần lưu ý

  • • Cần GPU NVIDIA từ 12 GB VRAM, khoảng 50 GB RAM trống và SSD nhanh
  • • Tệp W4A8 được khuyên dùng vẫn có dung lượng khoảng 44 GB
  • • Số liệu tốc độ trong tài liệu được đo chủ yếu trên RTX 4090 nên máy khác có thể chậm hơn đáng kể

Nguồn tham khảo

Link ngoài và tài liệu liên quan

  • Nguồn

    Access Gate

    0/1 bước

    Hoàn thành 1 bước để tiếp tục

    Chạy HunyuanImage 3.0 ngay trong ComfyUI với GPU từ 12 GB

    Direct sponsor Chưa hoàn thành

    Mở trang nhà tài trợ

    Đây là liên kết nhà tài trợ/cross-promo độc lập, không phải quảng cáo CPC bắt buộc click.

    Shopee · Tài trợ

    Mở tab nhà tài trợ

    Prototype hiện ghi proof trên trình duyệt. Production sẽ xác minh bằng Worker/server.

    Chính
  • Nguồn

    Access Gate

    0/1 bước

    Hoàn thành 1 bước để tiếp tục

    Chạy HunyuanImage 3.0 ngay trong ComfyUI với GPU từ 12 GB

    Direct sponsor Chưa hoàn thành

    Mở trang nhà tài trợ

    Đây là liên kết nhà tài trợ/cross-promo độc lập, không phải quảng cáo CPC bắt buộc click.

    Shopee · Tài trợ

    Mở tab nhà tài trợ

    Prototype hiện ghi proof trên trình duyệt. Production sẽ xác minh bằng Worker/server.