Dán kịch bản, chọn một giọng bạn đã nghe thử, chọn ngôn ngữ và nhận file MP3 tự nhiên chỉ trong vài giây. Hơn 80 giọng ElevenLabs, 18 ngôn ngữ, tối đa 5.000 ký tự mỗi lần tạo.
Bốn bước, một màn hình. Đây là cùng một dự án, lời dẫn cho một video ngắn về nông trại cà phê, đi từ dòng chữ đầu tiên đến file MP3 đã tải về.
Viết đúng như cách nó cần được nói: dấu phẩy và dấu chấm tạo khoảng ngắt, dấu chấm hỏi lên giọng cuối câu. Mỗi lần tạo nhận tối đa 5.000 ký tự, đủ cho vài phút lời dẫn, và bộ đếm trực tiếp cho bạn biết mình đang ở đâu.
Để ngôn ngữ ở chế độ Tự động và mô hình sẽ nhận diện từ văn bản của bạn. Hãy cố định khi một câu ngắn có thể bị đọc sai giọng. Có 18 ngôn ngữ, từ tiếng Anh, tiếng Tây Ban Nha, tiếng Pháp đến tiếng Nhật, tiếng Hàn, tiếng Hindi, tiếng Ả Rập và tiếng Trung phổ thông.
Mọi giọng trong danh sách đều phát bản nghe thử trước khi bạn tốn bất cứ thứ gì. Hơn 80 giọng ElevenLabs, nam và nữ, từ người dẫn chuyện điềm tĩnh đến MC đầy năng lượng. Đã nhân bản giọng của chính mình? Giọng đó nằm trong cùng danh sách, ở mục Giọng nhân bản của tôi.
Chi phí ước tính hiện ra trước khi bạn nhấn Tạo. Âm thanh trả về trong trình phát dạng sóng, được lưu vào thư viện và tải về dưới dạng MP3, sẵn sàng cho trình dựng video, podcast hay bài thuyết trình.
Công nghệ chuyển văn bản thành giọng nói cũ đọc từng từ một. Công cụ Tạo giọng nói AI của ClipNova chạy trên ElevenLabs Eleven v4, một mô hình giọng nói đọc trọn câu như con người: lấy hơi ở dấu phẩy, chậm lại ở từ quan trọng và lên giọng khi hỏi. Vì vậy chỉ một kịch bản đã cho bạn bản lồng tiếng dùng được ngay, chứ không phải bản nháp phải thu lại.
Thư viện giọng đọc giống với phần còn lại của ClipNova, nên người dẫn chuyện trong video AI và người đọc một file MP3 riêng có thể là cùng một người. Cùng một giọng có thể đọc kịch bản của bạn bằng bất kỳ ngôn ngữ nào trong 18 ngôn ngữ, giúp đăng cùng một kịch bản cho nhiều thị trường thật đơn giản.
Nếu không có giọng có sẵn nào phù hợp, hãy nhân bản giọng của bạn bằng Nhân bản giọng nói AI trong gói trả phí: thu một mẫu ngắn một lần và giọng đó xuất hiện trong danh sách, sẵn sàng đọc bất kỳ kịch bản nào bạn nhập.
Cho mọi video cùng một người dẫn chuyện ổn định mà không cần thu một lần nào, và đổi ngôn ngữ cho kênh thứ hai.
Sửa một dòng trong kịch bản và tạo lại trong vài giây thay vì đặt thêm một buổi thu âm.
Biến kịch bản bài học thành âm thanh rõ ràng, nhịp đều, rồi sửa một câu sau đó mà không phải thu lại cả học phần.
Dùng người dẫn chuyện AI cho truyện ngắn, phần mở đầu podcast, thông báo sản phẩm hoặc âm thanh hỗ trợ tiếp cận.
Là công cụ biến văn bản viết thành âm thanh lời nói với giọng chân thực, còn gọi là chuyển văn bản thành giọng nói bằng AI (AI TTS) hay người dẫn chuyện AI. Trong ClipNova, bạn nhập kịch bản, chọn giọng và ngôn ngữ, rồi tải kết quả về dưới dạng MP3.
Hơn 80 giọng ElevenLabs, nam và nữ, mỗi giọng có bản nghe thử, trong 18 ngôn ngữ: tiếng Anh, Tây Ban Nha, Pháp, Đức, Ý, Bồ Đào Nha, Nga, Nhật, Hàn, Trung phổ thông, Ả Rập, Hindi, Indonesia, Hà Lan, Ba Lan, Thổ Nhĩ Kỳ, Việt và Thụy Điển.
Tối đa 5.000 ký tự mỗi lần tạo, tương đương vài phút lời nói. Với kịch bản dài hơn, hãy chia tại chỗ xuống đoạn và tạo từng phần bằng cùng một giọng.
Có. Nhân bản giọng bằng Nhân bản giọng nói AI (có trong các gói trả phí) từ một mẫu dài 5 đến 60 giây. Bản nhân bản sẽ xuất hiện trong danh sách giọng của công cụ Tạo giọng nói AI và có thể nói 10 ngôn ngữ.
MP3. File phát ngay trên trình duyệt, được lưu vào thư viện ClipNova của bạn và có thể tải về cho mọi trình dựng, nền tảng podcast hay công cụ thuyết trình.
Tạo giọng nói được tính bằng credit theo độ dài văn bản, và chi phí ước tính hiện ra trước khi tạo. Mọi tài khoản mới đều bắt đầu với 70 credit miễn phí, không cần thẻ; các gói trả phí bắt đầu từ $19 mỗi tháng và bao gồm đầy đủ quyền thương mại.
Dấu câu quyết định nhịp điệu: dấu phẩy cho khoảng ngắt ngắn, dấu chấm cho khoảng ngắt dài hơn. Viết số theo cách đọc, và cố định ngôn ngữ khi một câu ngắn có thể bị đọc sai giọng.
Tham gia cùng các nhà sáng tạo biến ý tưởng thành video khiến người xem dừng lướt, không cần ê-kíp, phần mềm hay thời gian học.