Quay lại tất cả mô hình

ElevenLabs / Voice

ElevenLabs.
Cho câu chuyện tiếng nói của nó.

ElevenLabs cung cấp mô hình tạo lời nói biến văn bản thành âm thanh nói. Nó thuộc lớp âm thanh trong quy trình làm video bằng AI: tường thuật, đối thoại nhân vật và đường tiếng địa phương. Giọng nói cần truyền cùng ý định với phân cảnh mà nó đi kèm.

Bên trong câu chuyệnVoice
Nhân vật hư cấu Anaya và Kabir đối diện nhau qua một bàn ánh sáng ấm.
Bản tóm tắt cảnh của AI DirectorCùng một ý định, bằng ngôn ngữ khác.
01 / Kịch bản

Phê duyệt ý nghĩa, mức ngôn ngữ và tên nhân vật.

02 / Giọng nói

Thử vai giọng đã chọn bằng ngôn ngữ dự định.

03 / Thời điểm

Điều chỉnh khoảng lặng và độ dài câu thoại phù hợp với cắt dựng của cảnh.

Ý tưởng câu chuyện hư cấu. Minh họa nghệ thuật, không phải sản phẩm từ mô hình được giới thiệu.

Model capabilities

ElevenLabs mang gì vào phần soundtrack

Văn bản thành giọng nói
Tạo âm thanh nói từ kịch bản bằng cách dùng một giọng nói được chọn.
Lời nói đa ngôn ngữ
Các mô hình được hỗ trợ bao gồm nhiều ngôn ngữ. Tính khả dụng của ngôn ngữ và mức độ phù hợp của một giọng nói phụ thuộc vào từng mô hình và đường âm (track).
Lựa chọn giọng nói và cách thể hiện
Việc lựa chọn giọng nói và các điều khiển theo mô hình giúp định hình cách diễn đạt. Thử giọng với lời thoại thực tế thay vì dựa vào mẫu chung.

Các năng lực mô tả các họ mô hình, không phải đảm bảo rằng mọi phiên bản hoặc kiểm soát đều có sẵn trong Tosheo. Quyền truy cập sản xuất phụ thuộc vào nhà cung cấp, tài liệu tham chiếu, quyền và phạm vi được phê duyệt.

02 / ElevenLabs

Vị trí của ElevenLabs trong câu chuyện của bạn

ElevenLabs phù hợp cho phần tường thuật, bản thảo đối thoại và sản xuất đường tiếng. AI Director của Tosheo có thể kết nối kịch bản với giọng nhân vật, hướng dẫn phát âm và chỉnh sửa liên quan. Kiểm duyệt ngôn ngữ địa phương đánh giá cả ý nghĩa và giọng điệu lẫn âm chất của câu nói, nên việc dịch vẫn là một quyết định kể chuyện.

Fictional exampleCùng một ý định, bằng ngôn ngữ khác.

Kabir thì thầm tên Anaya. Giữ lại sự do dự và mối quan hệ khi chuyển ngữ câu thoại.

Kịch bản
Phê duyệt ý nghĩa, mức ngôn ngữ và tên nhân vật.
Giọng nói
Thử vai giọng đã chọn bằng ngôn ngữ dự định.
Thời điểm
Điều chỉnh khoảng lặng và độ dài câu thoại phù hợp với cắt dựng của cảnh.

03 / ElevenLabs

Lên kế hoạch chuyển giao ElevenLabs

AI Director chuẩn bị yêu cầu giọng nói từ kế hoạch cảnh, sử dụng AI Skills để xác định khung hình, diễn xuất hoặc ý định âm thanh. Bạn có thể xem lại phần chuẩn bị sáng tạo hoặc dùng chế độ Auto trong phạm vi bạn chọn. Mô hình nhận một nhiệm vụ có giới hạn, với các tham chiếu và ràng buộc quan trọng đối với tài sản đó.

Với một nhà sáng tạo độc lập, điều này nối một quyết định sáng tạo với bước sản xuất tiếp theo. Với một nhà xuất bản, nó giữ các tài sản định kỳ gắn với kế hoạch tập. Người mua thương hiệu có thể đưa các tham chiếu sản phẩm đã được phê duyệt vào cảnh quay; các hãng sản xuất có thể giữ bản xử lý và yêu cầu bàn giao xuyên suốt chuỗi.

04 / ElevenLabs

Một bản sắc, nhiều ngôn ngữ

Tham chiếu giọng đã được phê duyệt là canon giống như một khuôn mặt. Nó đi theo nhân vật, được kế thừa bởi mọi cảnh quay, và thay đổi nó cần có đánh giá.

Phần đặc thù cho giọng nói là danh tính phải tồn tại khi đổi ngôn ngữ. Đó là lý do các track ngôn ngữ được khai báo khi bật xanh: giọng nói được chọn đối chiếu với mọi track đã khai báo trước khi được phê duyệt, chứ không phải tìm giọng thứ hai sau đó để khớp với một diễn xuất mà nó chưa từng được casting cho.

  1. 01
    Khai báo các track tại greenlight

    Xác định ngôn ngữ chính và các track bổ sung tại greenlight. Xác nhận giọng đã chọn hoạt động với từng track trước khi phê duyệt.

  2. 02
    Đặt giọng (cast the voice) đối chiếu với tất cả các đường tiếng

    Một nhận dạng chỉ giữ được trong một ngôn ngữ là thất bại ngay trước khi bắt đầu sản xuất.

  3. 03
    Ghi lại phát âm như là canon

    Tên, địa điểm, cách diễn đạt theo vùng và phong cách ngôn ngữ. Kiểm tra trong QA thay vì quyết lại từng buổi.

  4. 04
    Xem từng track theo ngôn ngữ gốc

    Một người phê duyệt được đặt tên cho mỗi track. Một người rà soát tiếng Hindi không thể ký thay cho tiếng Tamil.

  5. 05
    Sửa chữa ở cấp phân đoạn

    Một câu thoại phát âm sai là một đoạn âm thanh, không phải một track và không phải một tập.

05 / ElevenLabs

Các quy tắc quyền, được nêu rõ ràng

  • Không nhân bản giọng nói của người thật nếu không có giấy phép được xác minh
  • Không sử dụng hình ảnh hay giọng nói của người nổi tiếng ở bất kỳ thể loại nào nếu không có giấy phép được xác minh
  • Không được sử dụng giọng nói ngoài lãnh thổ, thời hạn hoặc nền tảng mà giấy cấp quyền quy định
  • Không sản xuất lời chứng thực có tính lừa dối
  • Không được gỡ bỏ thông báo nội dung tổng hợp nơi mà thông báo đó là bắt buộc

Khi có một quyền, nó được ghi lại cùng với lãnh thổ, thời hạn, nền tảng và ngày hết hạn giống như mọi quyền khác, và ngày hết hạn là một dữ liệu hệ thống lưu chứ không phải thứ người ta mong nhớ hai năm sau.

06 / ElevenLabs

Đánh giá mô hình giọng nói ngay trong cảnh thực tế

Tài liệu nhà cung cấp

Các năng lực được kiểm tra đối chiếu với nguồn chính thức. Ứng dụng câu chuyện là các ví dụ biên tập của Tosheo, không phải điểm chuẩn so sánh.

Tài liệu ElevenLabs text-to-speech

Câu hỏi trước khi sản xuất

Tôi có thể nhân bản giọng nói của chính mình không?

Với sự cho phép được xác minh — đối với giọng nói của chính bạn, điều đó có nghĩa là xác minh đó là của bạn — có, và điều đó được ghi lại như một quyền cấp kèm lãnh thổ, thời hạn và ngày hết hạn. Bước xác minh không phải là thủ tục hình thức mà chúng tôi có thể bỏ qua chỉ vì người yêu cầu nghe tự tin.

Làm sao ngăn nhân vật nghe khác khi sang ngôn ngữ khác?

Bằng cách chọn giọng đọc cho mỗi track ngôn ngữ đã khai báo trước khi phê duyệt, thay vì ghép một giọng thứ hai vào một bản trình diễn hoàn thiện. Đó là quyết định duy nhất ảnh hưởng nhiều nhất đến việc một track khu vực có hiệu quả hay không, và quyết định đó được đưa ra lúc phê duyệt.

Ai sửa tên bị phát âm sai?

Hướng dẫn phát âm là canon, nên cách sửa là một hiệu chỉnh canon cùng với sửa chữa có mục tiêu các đoạn âm thanh bị ảnh hưởng. Hình ảnh, các track khác và phần còn lại của tập phim không bị động chạm.

Yêu cầu công bố nội dung tổng hợp có áp dụng cho audio không?

Nghĩa vụ tiết lộ gắn với sản phẩm giao và được kiểm tra trong gói giao. Đối với sản xuất nhiều tập khi ra mắt, phụ đề và thông báo về phương tiện tổng hợp được bật mặc định.

Các bạn dùng một nhà cung cấp giọng nói cho mọi thứ không?

Việc định tuyến xem xét phạm vi ngôn ngữ và độ tin cậy phát âm theo từng track, vì vậy một sản xuất có thể dùng nhà cung cấp khác nhau cho các track khác nhau. Bất cứ gì được dùng sẽ được ghi lại trong nguồn gốc của mỗi tài sản được chấp nhận.

AI Director + AI Skills + Models

Mô hình tạo ra một tài sản. AI Director của bạn kết nối câu chuyện.

  1. 01

    Sự chỉ đạo của bạn

    Chia sẻ brief, định dạng, kế hoạch tập và ngôn ngữ dự định.

  2. 02

    AI Director

    Xây dựng storyboard, tư liệu tham khảo và chỉ đạo trên cấp độ cảnh quay với AI Skills.

  3. 03

    Độ phù hợp của mô hình

    Phù hợp tài sản với mô hình có sẵn và phạm vi sản xuất được phê duyệt.

  4. 04

    tư liệu sẵn sàng cho câu chuyện

    Xem kết quả trong bối cảnh, sửa những chỗ cần chú ý và lắp ráp bản chỉnh sửa.

Tự mình xem xét công tác chuẩn bị sáng tạo hoặc dùng chế độ Auto trong phạm vi bạn chọn. Việc ủy quyền chi phí, kiểm duyệt quyền và chấp nhận giao hàng cuối cùng vẫn là các quyết định rõ ràng.

More from the model library

Tiếp tục xây dựng câu chuyện.

Tosheo / AI-native production

Bắt đầu với cảnh.
Để đạo diễn liên kết điều đó.

Xem cách Tosheo đưa brief, AI Skills, việc sinh tạo và đánh giá vào một quy trình sản xuất.