Thuật toán sẽ là thế này. Từ video muốn dịch dùng FFMPEG tách âm ra. Sau đó dùng Model Whisper băm nhỏ nhiều đoạn âm thanh đó để tạo file phụ đề Srt tiếng trung. Cuối cùng là đưa file srt đó cho một mô hình AI nào đó dịch như Grok, Gemini, Deepsek qua API. Đưa thuật toán này cho GPT bảo nó hướng dẫn build. Rồi dùng con Codex nó build cho