跳到主要內容區
 
清華大學

人工智慧應用

AI for Speech

隨著語音人工智慧與大型語言模型(Large Language Models, LLMs)的快速發展,建構能夠展現同理心的口語對談機器人成為一個重要且具挑戰性的研究方向。傳統的語音技術多聚焦於語言內容的正確性與合成品質,然而在人機互動中,僅能理解文字層面的訊息仍不足以支撐真實且有溫度的交流。人類的溝通不僅依賴語言內容,更仰賴聲音所傳遞的情緒與情感狀態。因此,我們的研究以 LLM 為基礎,從三個核心面向出發──辨識、生成與回應──逐步構建一個能進行情緒理解與同理心回應的口語對談系統。

Speech

 

AI加速器

透過 TVM 與 AutoTVM 對深度學習模型進行編譯與自動化優化,可搜尋出最佳的 資料流 (dataflow) 與 tiling 配置,並結合 SystemC 模擬器進行效能預測,迭代選擇最優解。最終結果能將最佳配置應用到 NoC-based 1-D PE Array 加速器架構,實現高效能運算。

參與教授: 李祈均、邱瀞德

瀏覽數:
登入成功