Tất cả bài viết

// Posts#video-editor

#9632026-03-08

LatentSync: ByteDance Open-Source Model Lip-Sync Tốt Nhất Hiện Tại

LatentSync của ByteDance đạt 94% SyncNet accuracy trên HDTF, vượt qua Wav2Lip, DINet, MuseTalk về mọi chỉ số chất lượng. Chỉ cần 8GB VRAM để chạy inference, hoàn toàn miễn phí và open-source. Dựa trên Stable Diffusion 1.5 với cơ chế TREPA độc quyền giúp giữ temporal consistency mà không làm giảm độ chính xác lip-sync.

latentsyncbytedancelip-sync

6 phút đọc

#9642025-05-08

ComfyUI_PuLID_Flux_ll: Giải quyết model pollution và tự do thương mại với FaceNet

ComfyUI_PuLID_Flux_ll giải quyết triệt để vấn đề model pollution trong PuLID Flux gốc - nhân vật chèn vào không còn làm hỏng style và ánh sáng ảnh. FaceNet thay thế InsightFace, xóa bỏ hoàn toàn ràng buộc ArcFace license cho dự án thương mại. Chạy được trên GPU 16GB với fp8 + offload, hỗ trợ TeaCache và WaveSpeed tăng tốc inference. Dựa trên PuLID - phương pháp face identity customization tuning-free được chấp nhận tại NeurIPS 2024.

comfyuifluxface-identity

6 phút đọc