繁體
關注我們
  • Facebook
  • YouTube
  • Instagram
  • TikTok
  • X
首頁wiki語音控制

語音控制

2026-08-24 18:00:01

語音控制係汽車智能座艙其中一項核心互動功能,佢允許駕駛者同乘客透過口頭指令嚟操控車輛嘅各項功能,無需手動操作按鈕或者觸摸螢幕。

工作原理

語音控制嘅運作流程通常包含以下四個環節:

  1. 喚醒與採集:透過麥克風陣列採集聲音。用戶講出喚醒詞(如「你好,小X」)或者按壓方向盤上面嘅語音按鈕,系統隨即啟動,並利用降噪演算法過濾路噪、風噪等同背景音響。

  2. 語音識別(ASR):將採集到嘅聲音訊號轉化為文本。現代系統已能識別方言同自然口語(如「我有啲冷」)。

  3. 語義理解(NLU):解析文本中嘅意圖同關鍵資訊。例如,對於「打開車窗」指令,識別出意圖係「車窗控制」,對象係「全部車窗」,動作係「打開」。

  4. 執行與反饋:生成控制指令發送畀車輛相應嘅電子控制單元(ECU),並透過語音或者螢幕文字向用戶反饋結果。

主要控制範圍

現代汽車嘅語音控制已經覆蓋除駕駛操作外嘅大部分座艙功能:

  • 車控類:冷氣溫度同風量、車窗同天窗開關、座椅加熱/通風/按摩、後視鏡摺疊、氣氛燈顏色切換。

  • 導航類:設定目的地、查詢沿途充電站/加油站、查看實時路況。

  • 娛樂類:播放特定歌曲、切換電台、調節音量。

  • 資訊類:查詢天氣、股票、航班資訊,或者進行簡單計算。

關鍵技術趨勢

語音控制技術正從「被動響應」向「主動服務」演進,主要趨勢包括:

  1. 全場景可見即可講:用戶喺中控螢幕度睇到任何帶文字嘅按鈕,均可直接透過語音控制,無需逐級翻找選單。

  2. 大模型賦能:基於大語言模型(如DeepSeek)嘅車載語音助手,具備更強嘅上下文理解同推理能力,能夠處理「先導航去公司,再推薦沿途嘅咖啡店」呢類複雜指令。

  3. 多音區識別:系統能夠區分主駕、副駕及後排乘客嘅指令,實現分區控制,避免互相干擾。

  4. 車外語音控制:部分車型支持車外喚醒,可語音控制車尾箱開關或者泊車,方便雙手持物時嘅操作。

典型應用

  • 小米SU7:支持多音區識別,能夠同「小愛同學」生態聯動,實現車家互控。

  • 小鵬汽車:全場景語音2.0系統響應速度極快,支持連續對話同四音區鎖定。

  • 梅賽德斯 - 奔馳 MBUX:率先同ChatGPT集成,令語音交互更加自然同擬人化。

安全注意事項

語音控制雖然能減少駕駛分心,但仍需留意:喺嘈雜環境(如高速行駛、暴雨)下識別率可能下降;系統對地方口音或者生僻詞彙可能誤判;當系統未能正確執行時,仍需駕駛員手動操作以確保安全。

意見反饋