語音控制係汽車智能座艙其中一項核心互動功能,佢允許駕駛者同乘客透過口頭指令嚟操控車輛嘅各項功能,無需手動操作按鈕或者觸摸螢幕。
語音控制嘅運作流程通常包含以下四個環節:
喚醒與採集:透過麥克風陣列採集聲音。用戶講出喚醒詞(如「你好,小X」)或者按壓方向盤上面嘅語音按鈕,系統隨即啟動,並利用降噪演算法過濾路噪、風噪等同背景音響。
語音識別(ASR):將採集到嘅聲音訊號轉化為文本。現代系統已能識別方言同自然口語(如「我有啲冷」)。
語義理解(NLU):解析文本中嘅意圖同關鍵資訊。例如,對於「打開車窗」指令,識別出意圖係「車窗控制」,對象係「全部車窗」,動作係「打開」。
執行與反饋:生成控制指令發送畀車輛相應嘅電子控制單元(ECU),並透過語音或者螢幕文字向用戶反饋結果。
現代汽車嘅語音控制已經覆蓋除駕駛操作外嘅大部分座艙功能:
車控類:冷氣溫度同風量、車窗同天窗開關、座椅加熱/通風/按摩、後視鏡摺疊、氣氛燈顏色切換。
導航類:設定目的地、查詢沿途充電站/加油站、查看實時路況。
娛樂類:播放特定歌曲、切換電台、調節音量。
資訊類:查詢天氣、股票、航班資訊,或者進行簡單計算。
語音控制技術正從「被動響應」向「主動服務」演進,主要趨勢包括:
全場景可見即可講:用戶喺中控螢幕度睇到任何帶文字嘅按鈕,均可直接透過語音控制,無需逐級翻找選單。
大模型賦能:基於大語言模型(如DeepSeek)嘅車載語音助手,具備更強嘅上下文理解同推理能力,能夠處理「先導航去公司,再推薦沿途嘅咖啡店」呢類複雜指令。
多音區識別:系統能夠區分主駕、副駕及後排乘客嘅指令,實現分區控制,避免互相干擾。
車外語音控制:部分車型支持車外喚醒,可語音控制車尾箱開關或者泊車,方便雙手持物時嘅操作。
小米SU7:支持多音區識別,能夠同「小愛同學」生態聯動,實現車家互控。
小鵬汽車:全場景語音2.0系統響應速度極快,支持連續對話同四音區鎖定。
梅賽德斯 - 奔馳 MBUX:率先同ChatGPT集成,令語音交互更加自然同擬人化。
語音控制雖然能減少駕駛分心,但仍需留意:喺嘈雜環境(如高速行駛、暴雨)下識別率可能下降;系統對地方口音或者生僻詞彙可能誤判;當系統未能正確執行時,仍需駕駛員手動操作以確保安全。