Treble gọi vốn 18 triệu USD cho mô phỏng giọng nói

Treble huy động 18 triệu USD để mở rộng nền tảng mô phỏng âm thanh phục vụ AI giọng nói, thiết bị đeo, robot và phần cứng tiêu dùng.

Đồng sáng lập Treble Finnur Pind giới thiệu công nghệ mô phỏng âm thanh
Finnur Pind, đồng sáng lập Treble. Ảnh: Treble

Treble là công ty công nghệ âm thanh có trụ sở tại Iceland. Công ty đã huy động 18 triệu USD trong đợt mở rộng vòng A để phát triển nền tảng mô phỏng âm thanh cho AI giọng nói, thiết bị đeo và robot. Theo TechCrunch, Paladin Capital Group dẫn dắt khoản đầu tư. KOMPAS VC, Frumtak Ventures, EIC và Omega ehf cũng tham gia.

Khoản vốn được công bố khi các nhà phát triển mô hình giọng nói và nhà sản xuất phần cứng cần thử nghiệm sản phẩm. Việc thử nghiệm phải diễn ra trong nhiều môi trường âm thanh. Nền tảng của Treble mô phỏng cách âm thanh truyền trong các điều kiện khác nhau. Kết quả mô phỏng tạo dữ liệu và phản hồi cho quá trình phát triển sản phẩm.

Nội dung phát triển nền tảng mô phỏng âm thanh của Treble

Treble cung cấp một lớp hạ tầng mô phỏng âm học cho các đơn vị phát triển AI giọng nói, robot và thiết bị tiêu dùng. Công nghệ của công ty tái tạo cách âm thanh truyền và thay đổi trong môi trường ảo. Khách hàng có thể đánh giá mô hình hoặc thiết bị trước khi thử nghiệm ngoài thực tế.

Hai kỹ sư âm học Finnur Pind và Jesper Pedersen thành lập Treble vào năm 2020. TechCrunch cho biết công ty từng nhận khoản đầu tư 12 triệu USD vào năm 2024. Sau đợt huy động mới, tổng vốn Treble đã nhận vượt 40 triệu USD. Amazon và Logitech nằm trong danh sách khách hàng của công ty.

Nền tảng này là một lớp thử nghiệm chuyên biệt trong hệ thống hạ tầng AI, nơi dữ liệu đánh giá có ảnh hưởng trực tiếp đến chất lượng của mô hình và sản phẩm sử dụng âm thanh.

Dữ liệu tổng hợp cho mô hình âm thanh

Đối với các công ty phát triển AI giọng nói, Treble tạo dữ liệu tổng hợp để tăng cường tín hiệu tiếng nói, khử tiếng ồn và huấn luyện mô hình. Nền tảng cũng đánh giá mô hình trong nhiều điều kiện âm thanh, sau đó cung cấp kết quả cho các nhóm nghiên cứu và phát triển.

Theo TechCrunch, Treble đã hợp tác với Hugging Face để công bố một bộ đánh giá mô hình nhận dạng tiếng nói trong các điều kiện thực tế. Công cụ này giúp kiểm tra khả năng nhận dạng tiếng nói khi điều kiện âm học thay đổi.

Finnur Pind cho rằng dữ liệu là thách thức cốt lõi của AI âm thanh. Theo ông, phần lớn hệ thống AI xử lý âm thanh hiện được xây dựng từ các bản ghi và dữ liệu lấy trên mạng. Mô phỏng vật lý bổ sung một cách tạo dữ liệu khác cho các thế hệ mô hình và phần cứng tiếp theo.

Thử tai nghe, loa và kính thông minh trong môi trường ảo

Treble cho phép các hãng tai nghe và loa tạo nguyên mẫu ảo để đánh giá âm thanh trước khi hoàn thiện phần cứng. Nền tảng cũng có thể mô phỏng khả năng một loa thông minh nhận lệnh tại các vị trí khác nhau.

Công ty gần đây mở rộng hoạt động mô phỏng sang kính thông minh và các thiết bị tích hợp AI. Hướng phát triển này liên quan đến cách thiết bị đeo thu nhận âm thanh, một vấn đề cũng xuất hiện khi AI trên đồng hồ thông minh làm phổ biến trạng thái luôn lắng nghe.

Pind đặc biệt quan tâm đến thế hệ thiết bị đeo có thể giúp người dùng nghe rõ hơn trong môi trường âm học phức tạp. Trong ví dụ ông chia sẻ với TechCrunch, một người ngồi trong nhà hàng có thể chỉ muốn nghe những người trong phạm vi 2 mét. Người tham dự hội thảo có thể muốn giảm tiếng nói xung quanh.

Mở rộng sang robot, ô tô và thiết bị bay không người lái

Treble dự định mở rộng nền tảng sang AI vật lý, gồm robot, ô tô và thiết bị bay không người lái. Công nghệ mô phỏng cho phép các công ty thử nghiệm chức năng dựa trên âm thanh trong môi trường ảo. Sau đó, họ có thể triển khai chức năng trên thiết bị hoặc đưa sản phẩm vào điều kiện thực tế.

Francois Ruether, Phó chủ tịch Paladin Capital Group, nói với TechCrunch rằng khả năng mô phỏng nhiều mô hình và thiết bị là điểm nổi bật của Treble. Theo Ruether, lớp hạ tầng này sẽ có thêm giá trị khi nhiều sản phẩm cần nhận biết và xử lý âm thanh.

Ruether cũng cho biết khách hàng vẫn sở hữu mô hình, sản phẩm và quy trình phát triển của mình. Treble cung cấp hạ tầng âm học dùng chung được xây dựng quanh công nghệ mô phỏng, thay vì tiếp quản tài sản công nghệ của khách hàng.

Tiếp tục theo dõi Sine để cập nhật cách các công ty AI đưa mô phỏng âm thanh từ phòng nghiên cứu vào thiết bị thực tế.