Ứng dụng AI

Ứng dụng AI · Video Model

22 bài / 30 ngày · #8 trong 28 ứng dụng · 44 người viết

Bài viết trong cộng đồng có nhắc đến Veo — mẹo dùng, so sánh và sản phẩm làm bằng Veo.

Sắp xếp

MinimaX-H3 đã mở mã nguồn được hơn 1 tháng và đây là những gì mình làm được với nó

Mặc dù đây là mô hình đánh dấu bước ngoặt cho sáng tạo nội dung cá nhân, chấm dứt vị thế độc quyền của các ông lớn công nghệ nhưng mình thấy ít có hội nhóm đăng tin về nó. Hôm nay mời anh em cùng theo dõi 1 số điểm thú vị của mô hình này. ƯU ĐIỂM - Tạo video dài 15s chất lượng 1K, đầu vào bao gồm văn bản, ảnh, video, âm thanh. Nhất quán nhân vật, giọng nói, bối cảnh, đạo cụ. Nhân vật có thể nói tiếng việt. - Hiện đã có 1 số công nghệ cho phép tạo video 15s chỉ trong 13s, tức là về lí thuyết có thể tạo video livestream thời gian thực. - Chuyển động nhân vật, diễn xuất, logic, độ chân thực tiệm cận seedance 2.0 (80-90%) và mạnh dạn tự tin sút SORA, Veo omni ra chuồng gà. - Chạy hoàn toàn cục bộ trên máy tính cá nhân, không cần internet, chỉ tốn tiền điện. - Thời gian tạo 1 video dài 10s ở độ phân giải 1K mất khoảng 6 phút (trên VGA 16Gb) - Cực kì bám prompt, có thể tuân thủ các siêu prompt dài hơn 1 tờ A4. Điều khiển được từng chuyển động vi mô của nhân vật và bối cảnh. Tuân thủ đến mức trong prompt ghi tại thời điểm 00:01 xảy ra sự kiện gì thì trong video đầu ra sẽ đúng như vậy. - Có chế độ xem trước ở độ phân giải thấp, nếu cảm thấy ok thì cho chạy tiếp, không ok thì dừng ngay, sửa prompt, đổi seed chạy lại. - Mô hình này có sự hiểu biết sâu rộng về các nhân vật nổi tiếng, chương trình TV, cinema, comic, anime đại chúng, từ Tây đến Tàu. nhược điểm: - Không có ràng buộc đạo đức. - Không có kiểm duyệt nội dung (kể cả thể loại 18+) - Không chặn bản quyền. - Yêu cầu cấu hình máy tính cao, VRAM > 8Gb. - Cấu trúc prompt rất phức tạp. Tóm lại Minimax-H3 là giấc mơ của dân chơi local. Mộ mô hình mã nguồn mở nhưng có chất lượng vượt trội hơn đại đa số mô hình mã nguồn đóng hiện nay. Thật tuyệt vời khi có 1 ngày chúng ta có thể chạy 1 mô hình đẳng cấp SOTA trên máy tính cá nhân tầm trung.

Justin Võ

Justin Võ

29/09/2026

Thiệt ra khá bất ngờ là chỉ trong 3 năm, AI đã đẻ ra quá trời “mảnh ghép” mới

* Chạy model ngay trên máy (2023: Llama, Ollama, LM Studio) * Clone giọng nói (2023: ElevenLabs) * Text → CAD (2023: Zoo) * Text → Video (2024: Sora, Veo, Runway) * Nói chuyện với AI theo thời gian thực (2024: Gemini Live, ChatGPT Voice) * AI có bộ nhớ (2024: ChatGPT) * AI biết suy luận (2024: OpenAI o1, DeepSeek R1) * Vibe coding – nói cho AI biết mình muốn làm gì rồi để nó code (2024: Bolt, Lovable, v0) * AI điều khiển máy tính (2024: Claude, OpenAI Operator) * Cho AI kết nối với các công cụ khác (2024: MCP) * Deep Research – AI tự đi nghiên cứu một vấn đề (2024: Gemini, Perplexity, OpenAI Deep Research) * AI Agent – AI tự làm một chuỗi công việc (2025: Claude Code, Codex, Manus) * Chỉnh sửa hình bằng AI (2025: GPT-4o Images, Nano Banana) * Cho Agent tự thanh toán (2025: x402, AP2) * Skills – dạy AI cách làm một loại công việc cụ thể (2025: Claude Skills) * Personal Agent – AI riêng cho từng người (2026: Grokbot, Muse, Instinct)... tới khúc này rồi. Mỗi một mảnh ghép mới này đều có thể mở ra cơ hội cho hàng trăm công ty khác nhau. Cái đáng chú ý nhất là mấy công ty thú vị mình đang thấy thường không chỉ xài một thứ. Họ ghép 2–3 mảnh AI lại với nhau, rồi tập trung vô một nhu cầu hoặc một thị trường thật cụ thể. Nguồn: @gregisenberg

Xin chào mọi người .

Mình chia sẻ ứng dụng mình đang dùng để làm video AI,ai cần thì có thể tham khảo nhé! Mình làm content AI được một thời gian, cái khổ nhất là VEO3 với Nano Banana của Google rất mạnh nhưng để chạy hàng loạt thì phải thao tác thủ công rất nhiều bước, vừa mệt vừa mất thời gian. Nhiều khi còn bị giới hạn, không cho tạo liên tục. Mình nghĩ đơn giản thôi: tự build một tool để tự động hóa cái quy trình đó. Thực ra điểm mấu chốt là tài khoản Google Flow có giá khá rẻ mà lại tạo không giới hạn,nếu tích hợp được vào quy trình sản xuất thì lợi thế rất lớn. Đó là lý do mình làm cái này. Vậy là ra đời YagiMedia,bỏ nội dung vào là nó tự chạy qua Google Flow, tạo hình ảnh Nano Banana, dựng video VEO3, lồng tiếng, xuất file 720p hoặc 1080p, không cần ngồi canh từng bước. Ngoài ra còn giữ nhân vật đồng nhất xuyên suốt và tương tác được với đầy đủ các model của Google Flow. Hiện mình đang mở miễn phí cho anh chị em dùng thử chỉ cần đăng kí tài khoản và sử dụng. Có gì cứ hỏi mình trực tiếp nhé : [https://media.yagilogin.com](https://media.yagilogin.com/?fbclid=IwcGRvZgFleHRuA2FlbQIxMABicmlkETEwa1FzdllpcUZSWjM0YWg2c3J0YwZhcHBfaWQQMjIyMDM5MTc4ODIwMDg5MgABHgwBm41hgsZlVIrCJAKiVOue37INXQWI_zY3ta0sRnahKPESHi4JpXzyPNo7_aem_XRc-JMi0q2CG1Et9oxReCQ)

Em chào mn.

Mình đang thử làm AI Affiliate mảng thời trang và muốn xin thêm kinh nghiệm từ mọi người. Quy trình hiện tại của mình khá đơn giản: 1. Lấy ảnh sản phẩm quần áo. 2. Tạo một nhân vật AI cố định. 3. Thay sản phẩm lên nhân vật. 4. Dùng image-to-video để tạo chuyển động. 5. Lồng tiếng, ghép cảnh bằng CapCut rồi đăng TikTok. Khó khăn lớn nhất của mình hiện tại là tìm được model tạo video có chi phí hợp lý nhưng chất lượng vẫn đủ tốt để làm lâu dài. Một số lỗi mình thường gặp: * Khuôn mặt nhân vật bị thay đổi giữa các video. * Quần áo bị đổi form, họa tiết hoặc chất liệu khi chuyển động. * Tay và phụ kiện dễ bị biến dạng. * Nhân vật chuyển động khá “AI”, giống quay quảng cáo hơn vlog đời thường. * Camera tự zoom hoặc di chuyển dù prompt yêu cầu cố định. * Background đôi khi quá đẹp và bóng bẩy nên nhìn vào biết ngay là ảnh AI. Mình đang hướng tới dạng video thời trang gần gũi: nhân vật đứng trước camera, nói chuyện và review outfit như một người thật; chuyển động nhẹ, không cần quá cinematic. Hiện mình có thử Veo 3.1 Lite và một vài công cụ image-to-video, nhưng chi phí tạo lại nhiều lần vì lỗi vẫn khá cao. Không biết mọi người đang dùng model hoặc workflow nào có thể: * Giữ khuôn mặt và sản phẩm ổn định. * Tạo chuyển động tự nhiên. * Phù hợp với video thời trang/TikTok Affiliate. * Giá đủ rẻ để sản xuất khoảng 2–3 video mỗi ngày. Nếu có model mới, nền tảng giá rẻ hoặc workflow nào đáng thử, mọi người giới thiệu giúp mình nhé. Mình cũng sẵn sàng test những model mới và chia sẻ kết quả thực tế lại cho cộng đồng. Cảm ơn mọi người!

Justin Võ

Justin Võ

09/07/2026

Có thêm một GitHub repo theo đuổi ý tưởng "AI làm toàn bộ quy trình sản xuất video".

Repo này có tên Pixelle-Video [https://github.com/ATH-MaaS/Pixelle-Video](https://github.com/ATH-MaaS/Pixelle-Video) Thay vì chỉ hỗ trợ tạo video hay tạo ảnh, Pixelle-Video cố gắng tự động hóa gần như toàn bộ pipeline làm video ngắn. Bạn chỉ cần nhập một ý tưởng hoặc một chủ đề, hệ thống sẽ tự viết kịch bản, chia cảnh, tạo hình ảnh hoặc video bằng AI, tạo giọng đọc, chèn phụ đề và ghép thành một video hoàn chỉnh. Điểm mình thấy đáng chú ý là dự án này được thiết kế theo hướng pipeline chứ không phải một công cụ đơn lẻ. Toàn bộ các bước từ lên ý tưởng, viết nội dung, tạo media đến dựng video đều được kết nối lại thành một workflow. Ngoài ra, repo còn hỗ trợ tích hợp nhiều mô hình mã nguồn mở và API khác nhau, cho phép người dùng lựa chọn giữa chất lượng và chi phí tùy nhu cầu. Nếu cần sản xuất nhiều video cùng lúc, hệ thống cũng hỗ trợ chạy theo dạng hàng loạt, khá phù hợp với những workflow tạo nội dung số lượng lớn. Bên cạnh đó, dự án có thể triển khai trên máy chủ riêng, giúp người dùng tự kiểm soát hệ thống thay vì phụ thuộc hoàn toàn vào một nền tảng bên thứ ba. Trước đây, để làm một video ngắn thường phải đi qua nhiều công cụ: ChatGPT viết kịch bản, Midjourney hoặc Flux tạo ảnh, Veo hoặc Kling tạo video, ElevenLabs đọc lời thoại, CapCut dựng video... Giờ đây, ngày càng nhiều dự án mã nguồn mở cố gắng gom tất cả những bước đó vào một workflow duy nhất. Người dùng không còn phải nghĩ nên mở công cụ nào trước, mà chỉ cần mô tả kết quả mình muốn, phần còn lại để hệ thống tự điều phối.