Hệ thống SYNC trên xe Ford hiểu các khẩu lệnh thế nào?

Tác giả: Minh Quang

Thế giới xe 13/07/2020 15:23

Công nghệ kích hoạt bằng giọng nói đã trở thành một phần của SYNC® ngay từ những phiên bản đầu tiên cách đây 13 năm.

Hệ thống SYNC trên xe Ford hỗ trợ người điều khiển xe ngày một nhiều hơn.

Đâu là nguồn cảm hứng cho con người làm việc hàng ngày? Đối với ông Stephen Cooper, trưởng nhóm nghiên cứu và phát triển công nghệ nhận diện giọng nói SYNC® 3, nguồn cảm hứng cho những đóng góp của ông vào hệ thống này xuất phát từ cảm giác an tâm khi biết người thân và bạn bè của ông được tập trung lái xe an toàn và không bị xao nhãng.

Sau nhiều lần chứng kiến những hậu quả đến từ việc lái xe mất tập trung, ông Cooper nhận ra sự cấp thiết trong việc tối ưu hóa công nghệ kích hoạt bằng giọng nói của SYNC®, bằng cách giản lược thông tin đầu vào xuống chỉ còn một câu lệnh.

Ông Cooper là nhân sự thuộc nhóm phát triển công nghệ nhận diện giọng nói của Ford, đơn vị chịu trách nhiệm phát triển các tính năng cho SYNC® 3. Việc xây dựng một hệ thống kích hoạt bằng giọng nói đơn giản và phù hợp cho người dùng là một trong những mục tiêu chính của nhóm.

Công nghệ kích hoạt bằng giọng nói đã trở thành một phần của SYNC® ngay từ những phiên bản đầu tiên cách đây 13 năm. Chính thức ra mắt vào năm 2014, SYNC® 3 đã và đang được cải tiến liên tục. Hiện nay, với khả năng hỗ trợ lên tới 25 ngôn ngữ, hệ thống này đã đem đến cơ hội trải nghiệm cho nhiều người dùng trên toàn thế giới hơn.

SYNC^® nhận diện giọng nói như thế nào?

Là trang bị tiêu chuẩn trên nhiều dòng xe khác nhau của Ford, SYNC® trở thành một trong những hệ thống kích hoạt bằng giọng nói trực quan và không thể thiếu. Thiết kế cốt lõi SYNC® là hệ thống nhận diện và ra lệnh bằng giọng nói với cụm dữ liệu ngôn ngữ tích hợp với phần mềm giải mã sẽ chia nhỏ âm thanh để phân tích và hiểu từng câu mệnh lệnh của người dùng.

Cụm dữ liệu ngôn ngữ là một danh sách lớn các từ ngữ hoặc câu lệnh được lập trình để thực hiện một nhiệm vụ cụ thể. Ngoài ra, một lượng lớn câu lệnh tương ứng với các tính năng (có thể kích hoạt bằng giọng nói trong) trên xe cũng được lưu trữ trong cụm dữ liệu ngôn ngữ của SYNC®.

Bên cạnh đó phần mềm giải mã giọng nói sẽ lọc ra đặc tính âm thanh của từng câu lệnh để khớp với danh sách các từ trong cụm dữ liệu ngôn ngữ. Giọng nói thuộc các vùng miền khác nhau trên cùng một quốc gia cũng được lưu ý. Ở những ngôn ngữ được hỗ trợ như tiếng Anh, tiếng Trung, tiếng Thái… có rất nhiều phương ngữ và giọng nói khác nhau giữa các vùng miền vì vậy dữ liệu ngôn ngữ cũng được cập nhật đa dạng để nâng cao khả năng nhận diện một câu lệnh của hệ thống.

Đặt con người vào vị trí trung tâm của sự phát triển

Nhóm Phát triển Công nghệ Nhận diện Giọng nói của Ford được lãnh đạo bởi bà Yvonne Gloria, người đã có những đóng góp đáng kể trong quá trình cải tiến công nghệ này, kể từ khi SYNC® 3 ra mắt công chúng vào năm 2014.

Sự tiến hoá không ngừng trên thế giới đã giúp các kỹ sư trong nhóm nỗ lực từng ngày để tinh chỉnh và mở rộng các tính năng của SYNC®. Bằng cách phân tích hành vi sử dụng SYNC® của khách hàng, các kỹ sư tiếp tục phát triển hệ thống trở nên trực quan và thân thiện hơn như tinh giản các tác vụ, hoặc đơn giản hóa việc truy cập. Qua quá trình đó, hơn 80% các câu lệnh của SYNC® đã có thể thực hiện chỉ với một bước.

Thông qua các nghiên cứu và phân tích chuyên sâu qua mạng không dây của SYNC® 3, các kỹ sư có thể ghi nhận một nguồn dữ liệu âm thanh đều đặn về cách khách hàng sử dụng SYNC® 3 cho các mục đích khác nhau. Từ đó, họ có thể phát hiện các lỗi phổ biến mà người dùng hay gặp phải, từ đó, sắp xếp và cải tiến các tác vụ phù hợp hơn, thay vì bỏ mặc người dùng tự xoay sở. Tất cả dữ liệu được thu thập đều phải có sự chấp thuận của người dùng.

Tương lai của công nghệ kích hoạt bằng giọng nói

Rất nhiều cơ hội được mở ra cho các phương tiện được trang bị SYNC®, nhằm nâng tầm trải nghiệm của người điều khiển xe. Đặc biệt, công nghệ hiện nay đang phát triển nhanh chóng và các màn hình giải trí cỡ lớn trên xe sẽ dần thay thế những nút bấm truyền thống, tạo nên một sân chơi đầy tiềm năng cho công nghệ kích hoạt bằng giọng nói trong tương lai.