Treble huy động 18 triệu USD cho nền tảng mô phỏng giọng nói
Startup Treble đến từ Iceland vừa gọi vốn thành công 18 triệu USD trong vòng mở rộng Series A do Paladin Capital Group dẫn dắt. Nền tảng mô phỏng âm thanh của công ty đang phục vụ các nhà phát triển mô hình AI giọng nói, thiết bị đeo AI và robot, với khách hàng lớn gồm Amazon và Logitech.

AI giọng nói đang nổi lên như một trong những lĩnh vực nóng nhất của trí tuệ nhân tạo, khi các nhà đầu tư đổ hàng tỷ USD vào những ứng dụng từ tự động hóa chăm sóc khách hàng, gọi điện bán hàng, cho đến ghi chú cuộc họp và kính thông minh dùng giọng nói làm giao diện tương tác chính.
Trong lúc đó, các phòng thí nghiệm AI liên tục tung ra mô hình mới, còn nhà sản xuất phần cứng thì chạy đua để mang đến trải nghiệm tương tác tốt nhất cho người dùng. Tất cả công nghệ non trẻ này đều cần được kiểm thử và có vòng phản hồi để cải thiện.
Nhà đồng sáng lập Treble, Finnur Pind
Đó chính là khoảng trống mà Treble, một startup đến từ Iceland, đang nhắm tới. Công ty xây dựng nền tảng mô phỏng phục vụ cả bên làm mô hình AI, công ty robot lẫn nhà sản xuất thiết bị tiêu dùng, qua đó đặt mình vào vị trí trung tâm của ngành AI giọng nói.
Gọi vốn 18 triệu USD, tổng vốn vượt 40 triệu USD
Treble được thành lập năm 2020 bởi hai kỹ sư âm học Finnur Pind và Jesper Pedersen. Công ty vừa công bố khoản đầu tư 18 triệu USD trong vòng mở rộng của Series A, do Paladin Capital Group dẫn dắt, cùng sự tham gia của các nhà đầu tư hiện hữu như KOMPAS VC, Frumtak Ventures, EIC và Omega ehf.
Trước đó, startup này đã nhận 12 triệu USD vào năm 2024, nâng tổng số vốn huy động đến nay lên hơn 40 triệu USD. Danh sách khách hàng của Treble hiện có những tên tuổi lớn như Amazon và Logitech.
Mô phỏng vật lý thay cho dữ liệu thu thập từ Internet
Treble hoạt động theo một số hướng chính gắn với mô phỏng và dữ liệu. Với các công ty AI giọng nói, họ cung cấp nền tảng tạo dữ liệu tổng hợp dùng cho việc tăng cường giọng nói, khử tiếng ồn và huấn luyện mô hình. Nền tảng còn đánh giá các mô hình AI giọng nói trong nhiều điều kiện khác nhau để trả phản hồi cho các phòng thí nghiệm.
Đầu năm nay, Treble bắt tay với Hugging Face để ra mắt bộ đánh giá chuẩn (benchmark) cho các mô hình nhận dạng giọng nói trong những điều kiện thực tế đa dạng.
"AI âm thanh thực chất là một bài toán dữ liệu, và đây là nơi tập trung nhiều cơ hội nhất để tạo ra các mô hình và phần cứng thế hệ mới. Đến nay, gần như toàn bộ AI liên quan đến âm thanh đều được xây dựng từ bản ghi âm và dữ liệu thu thập trên Internet. Chúng tôi tin rằng mô phỏng vật lý chính xác có thể là một cách thay thế để tạo dữ liệu cho âm thanh", Pind chia sẻ với TechCrunch.
Bên cạnh đó, startup cũng tập trung vào thiết kế và kiểm thử phần cứng dưới góc nhìn giọng nói. Chẳng hạn, họ làm việc với các hãng tai nghe và loa để tạo nguyên mẫu ảo, giúp họ hình dung sản phẩm sẽ nghe như thế nào. Nền tảng cũng có thể kiểm tra xem một chiếc loa thông minh hiểu khẩu lệnh ra sao tùy theo vị trí đặt loa. Gần đây, Treble mở rộng sang mô phỏng và kiểm thử cho kính thông minh cùng các thiết bị AI.
Hướng tới "thính giác siêu phàm" và AI vật lý
Pind cho biết công ty rất hào hứng với các thiết bị đeo có thể nâng cao khả năng nghe cho người dùng.
"Tôi thực sự phấn khích với thế hệ thiết bị tiếp theo như tai nghe và kính thông minh có thể mang lại tính năng kiểu 'thính giác siêu phàm'. Đó là lĩnh vực mà bạn có thể nghe rõ hơn trong những môi trường âm thanh đầy thách thức. Ví dụ bạn đang ở nhà hàng và chỉ muốn nghe người trong bán kính hai mét, hoặc bạn đang dự hội thảo và muốn tắt tiếng những người xung quanh", ông nói.
Trong thời gian tới, Treble đặt mục tiêu tăng cường tập trung vào mảng AI vật lý, bao gồm robot, ô tô và drone, nhằm hỗ trợ các chức năng dựa trên âm thanh thông qua kiểm thử và mô phỏng.
Ông Francois Ruether, Phó chủ tịch của Paladin Capital Group, nhận định nền tảng của Treble nổi bật nhờ khả năng mô phỏng nhiều mô hình và thiết bị khác nhau, đồng thời tầm quan trọng của nó sẽ ngày càng tăng khi công ty tham gia vào nhiều lĩnh vực hơn.
"Luận điểm của chúng tôi là khi ngày càng nhiều sản phẩm phụ thuộc vào việc hiểu âm thanh, hạ tầng này sẽ trở nên có giá trị hơn trên khắp các mảng AI giọng nói, thiết bị đeo, robot và AI vật lý. Khách hàng vẫn giữ quyền sở hữu mô hình, sản phẩm và quy trình phát triển của họ, đồng thời hưởng lợi từ nền tảng hạ tầng âm học thuần mô phỏng dùng chung", Ruether nói.
Ý nghĩa với thị trường công nghệ Việt Nam
Câu chuyện của Treble cho thấy một xu hướng đáng chú ý: khi các mô hình AI ngày càng phổ biến, nhu cầu về dữ liệu huấn luyện chất lượng cao và hạ tầng kiểm thử cũng tăng theo. Với các startup công nghệ Việt Nam đang phát triển sản phẩm AI, đặc biệt trong mảng xử lý giọng nói tiếng Việt và thiết bị thông minh, việc tận dụng các nền tảng mô phỏng như của Treble có thể giúp rút ngắn thời gian thử nghiệm và giảm chi phí thu thập dữ liệu thực tế.
Việc Amazon và Logitech đã tin dùng nền tảng này cũng phần nào cho thấy tiềm năng của mô phỏng âm thanh trong chuỗi giá trị AI, một mảng mà các công ty phần cứng và nhà phát triển mô hình trong khu vực có thể sẽ sớm để mắt tới.


