Ứng dụng AI

Ứng dụng AI · Video Model

3 bài / 30 ngày · #26 trong 28 ứng dụng · 3 người viết

Bài viết trong cộng đồng có nhắc đến Sora — mẹo dùng, so sánh và sản phẩm làm bằng Sora.

Sắp xếp

MinimaX-H3 đã mở mã nguồn được hơn 1 tháng và đây là những gì mình làm được với nó

Mặc dù đây là mô hình đánh dấu bước ngoặt cho sáng tạo nội dung cá nhân, chấm dứt vị thế độc quyền của các ông lớn công nghệ nhưng mình thấy ít có hội nhóm đăng tin về nó. Hôm nay mời anh em cùng theo dõi 1 số điểm thú vị của mô hình này. ƯU ĐIỂM - Tạo video dài 15s chất lượng 1K, đầu vào bao gồm văn bản, ảnh, video, âm thanh. Nhất quán nhân vật, giọng nói, bối cảnh, đạo cụ. Nhân vật có thể nói tiếng việt. - Hiện đã có 1 số công nghệ cho phép tạo video 15s chỉ trong 13s, tức là về lí thuyết có thể tạo video livestream thời gian thực. - Chuyển động nhân vật, diễn xuất, logic, độ chân thực tiệm cận seedance 2.0 (80-90%) và mạnh dạn tự tin sút SORA, Veo omni ra chuồng gà. - Chạy hoàn toàn cục bộ trên máy tính cá nhân, không cần internet, chỉ tốn tiền điện. - Thời gian tạo 1 video dài 10s ở độ phân giải 1K mất khoảng 6 phút (trên VGA 16Gb) - Cực kì bám prompt, có thể tuân thủ các siêu prompt dài hơn 1 tờ A4. Điều khiển được từng chuyển động vi mô của nhân vật và bối cảnh. Tuân thủ đến mức trong prompt ghi tại thời điểm 00:01 xảy ra sự kiện gì thì trong video đầu ra sẽ đúng như vậy. - Có chế độ xem trước ở độ phân giải thấp, nếu cảm thấy ok thì cho chạy tiếp, không ok thì dừng ngay, sửa prompt, đổi seed chạy lại. - Mô hình này có sự hiểu biết sâu rộng về các nhân vật nổi tiếng, chương trình TV, cinema, comic, anime đại chúng, từ Tây đến Tàu. nhược điểm: - Không có ràng buộc đạo đức. - Không có kiểm duyệt nội dung (kể cả thể loại 18+) - Không chặn bản quyền. - Yêu cầu cấu hình máy tính cao, VRAM > 8Gb. - Cấu trúc prompt rất phức tạp. Tóm lại Minimax-H3 là giấc mơ của dân chơi local. Mộ mô hình mã nguồn mở nhưng có chất lượng vượt trội hơn đại đa số mô hình mã nguồn đóng hiện nay. Thật tuyệt vời khi có 1 ngày chúng ta có thể chạy 1 mô hình đẳng cấp SOTA trên máy tính cá nhân tầm trung.

Justin Võ

Justin Võ

29/09/2026

Thiệt ra khá bất ngờ là chỉ trong 3 năm, AI đã đẻ ra quá trời “mảnh ghép” mới

* Chạy model ngay trên máy (2023: Llama, Ollama, LM Studio) * Clone giọng nói (2023: ElevenLabs) * Text → CAD (2023: Zoo) * Text → Video (2024: Sora, Veo, Runway) * Nói chuyện với AI theo thời gian thực (2024: Gemini Live, ChatGPT Voice) * AI có bộ nhớ (2024: ChatGPT) * AI biết suy luận (2024: OpenAI o1, DeepSeek R1) * Vibe coding – nói cho AI biết mình muốn làm gì rồi để nó code (2024: Bolt, Lovable, v0) * AI điều khiển máy tính (2024: Claude, OpenAI Operator) * Cho AI kết nối với các công cụ khác (2024: MCP) * Deep Research – AI tự đi nghiên cứu một vấn đề (2024: Gemini, Perplexity, OpenAI Deep Research) * AI Agent – AI tự làm một chuỗi công việc (2025: Claude Code, Codex, Manus) * Chỉnh sửa hình bằng AI (2025: GPT-4o Images, Nano Banana) * Cho Agent tự thanh toán (2025: x402, AP2) * Skills – dạy AI cách làm một loại công việc cụ thể (2025: Claude Skills) * Personal Agent – AI riêng cho từng người (2026: Grokbot, Muse, Instinct)... tới khúc này rồi. Mỗi một mảnh ghép mới này đều có thể mở ra cơ hội cho hàng trăm công ty khác nhau. Cái đáng chú ý nhất là mấy công ty thú vị mình đang thấy thường không chỉ xài một thứ. Họ ghép 2–3 mảnh AI lại với nhau, rồi tập trung vô một nhu cầu hoặc một thị trường thật cụ thể. Nguồn: @gregisenberg

Nguyễn Hữu Thịnh

Nguyễn Hữu Thịnh

08/09/2026

Help

Bác nào đang dùng RTX 5060 16GB để chạy AI local, đặc biệt là tạo video cho em xin ít trải nghiệm thực tế với ạ. Em đang phân vân giữa tự chạy AI local và sora ai trên web, muốn hỏi các bác: Tốc độ tạo video thực tế thế nào? Chất lượng video có ổn không? Một video khoảng 5–10 giây mất bao lâu? Bác nào đã dùng rồi cho em xin đánh giá thực tế với ạ.