Qwen PC 版新增 AI 語音輸入功能,可在應用程式中直接將語音轉為文字
5月7日,Qwen 推出了適用於個人電腦的 AI 語音輸入功能,讓使用者能在任何桌面應用程式中透過熱鍵啟動此功能。此功能不僅能刪除口頭語、修正錯誤並格式化語音內容,還能根據上下文調整回應內容。使用者亦可下達指令進行撰寫、回答問題或翻譯。
Qwen 的語音輸入功能展現了強大的語義解析能力。舉例來說,當輸入一段包含語音錯誤的語音片段,例如:「王老闆,會議安排在兩點……不,是三點,地點在舊會議室,記得帶那個…… 市場研究報告」,Qwen 能即時過濾「嗯」或「那個」等填充詞,修正錯誤,並直接輸出結構化文字:「王老闆,會議定於下午 3 點舉行,地點是舊會議室,請攜帶市場研究報告。」

將口語重構為結構化文本不僅是簡單的文字簡化,還涉及修正邏輯錯誤並對內容進行結構化組織。當使用者起草週報或會議紀錄時,即使表達方式在邏輯上有所斷裂,Qwen 也能根據上下文進行語義摘要。 例如,當使用者隨口提及工作進度時,Qwen 能自動將其整理成帶有清晰項目符號的結構化週報。
在工作或創作時,使用者無需離開編輯器,即可透過語音指令呼叫 Qwen。例如,若要將去年的 GDP 數據插入文本中,只需說:「插入 2025 年的全國 GDP 數據。」 瀏覽網站或閱讀專業英文論文時,若遇到不明白之處,選取文字並說「解釋這段」或「翻譯這段」,Qwen 便會自動提供解釋或翻譯。
在「DingTalk」、「WeChat」或電子郵件等情境中,使用者亦可要求 Qwen 根據上下文生成回覆。例如,回覆客戶的英文電子郵件時,使用者只需用中文口頭說明需求,Qwen 便會在輸入框中生成格式正確的英文回覆郵件。
目前,Qwen 的語音輸入功能已全面上線,所有使用者皆可透過 Qwen 電腦端應用程式自由使用此功能。
相關文章
Spotify 致力於成為人工智慧生成個人化音訊的內容樞紐
近年來,諸如 Google 的 NotebookLM、Hero 以及 Adobe Acrobat 等工具,讓使用者能夠從文件、行程表和文章等原始素材中生成播客。Spotify 現已允許使用者在其平台內存取這些音訊檔案,不過要使用這項功能,仍需借助特定的程式設計工具。據該公司表示,已使用 OpenAI 的 Codex、Anthropic 的 Claude Code 或 OpenClaw 等程式碼助理
AI LIVE 倫敦:重塑人工智慧與工業自動化
AI LIVE:倫敦峰會將於 2026 年 10 月 20 日至 21 日在倫敦奧林匹亞展覽中心舉行。圖片來源:BizClikAI LIVE:倫敦峰會匯聚全球領袖,共同解決營運瓶頸,並推動人工智慧在工業自動化領域的廣泛應用。工業效率的主要限制在於現有企業系統之間的手動交接。Ace Workflow 的最新數據顯示,透過針對性的自動化,可回收 26% 的記錄在案企業工時——而在財務部門,這一比例甚至
谷歌的 Genie 世界模型現在能夠模擬真實的街道,並整合街景功能
我們大多數人都曾使用 Google 街景向朋友展示我們以前的社羣,或者將那個小人圖示拖到巴黎,以檢查我們的酒店是否位於時尚區域。現在,想象一下以完全沉浸和互動的方式體驗這一功能——模擬街道及其周邊環境,調整天氣狀況,甚至視覺化“後天”中的極端場景。這正是 Google 最新整合背後的願景。從今天開始,Google DeepMind 將街景與 Project Genie 連結起來,後者是一個通用世界模型,能夠生成多樣化的互動式環境。該功能在 Google I/O 開發者大會上首次亮相。“這對於
相關專題推薦
評論 (1)
0/500
5月7日,Qwen 推出了適用於個人電腦的 AI 語音輸入功能,讓使用者能在任何桌面應用程式中透過熱鍵啟動此功能。此功能不僅能刪除口頭語、修正錯誤並格式化語音內容,還能根據上下文調整回應內容。使用者亦可下達指令進行撰寫、回答問題或翻譯。
Qwen 的語音輸入功能展現了強大的語義解析能力。舉例來說,當輸入一段包含語音錯誤的語音片段,例如:「王老闆,會議安排在兩點……不,是三點,地點在舊會議室,記得帶那個…… 市場研究報告」,Qwen 能即時過濾「嗯」或「那個」等填充詞,修正錯誤,並直接輸出結構化文字:「王老闆,會議定於下午 3 點舉行,地點是舊會議室,請攜帶市場研究報告。」

將口語重構為結構化文本不僅是簡單的文字簡化,還涉及修正邏輯錯誤並對內容進行結構化組織。當使用者起草週報或會議紀錄時,即使表達方式在邏輯上有所斷裂,Qwen 也能根據上下文進行語義摘要。 例如,當使用者隨口提及工作進度時,Qwen 能自動將其整理成帶有清晰項目符號的結構化週報。
在工作或創作時,使用者無需離開編輯器,即可透過語音指令呼叫 Qwen。例如,若要將去年的 GDP 數據插入文本中,只需說:「插入 2025 年的全國 GDP 數據。」 瀏覽網站或閱讀專業英文論文時,若遇到不明白之處,選取文字並說「解釋這段」或「翻譯這段」,Qwen 便會自動提供解釋或翻譯。
在「DingTalk」、「WeChat」或電子郵件等情境中,使用者亦可要求 Qwen 根據上下文生成回覆。例如,回覆客戶的英文電子郵件時,使用者只需用中文口頭說明需求,Qwen 便會在輸入框中生成格式正確的英文回覆郵件。
目前,Qwen 的語音輸入功能已全面上線,所有使用者皆可透過 Qwen 電腦端應用程式自由使用此功能。
Spotify 致力於成為人工智慧生成個人化音訊的內容樞紐
近年來,諸如 Google 的 NotebookLM、Hero 以及 Adobe Acrobat 等工具,讓使用者能夠從文件、行程表和文章等原始素材中生成播客。Spotify 現已允許使用者在其平台內存取這些音訊檔案,不過要使用這項功能,仍需借助特定的程式設計工具。據該公司表示,已使用 OpenAI 的 Codex、Anthropic 的 Claude Code 或 OpenClaw 等程式碼助理
AI LIVE 倫敦:重塑人工智慧與工業自動化
AI LIVE:倫敦峰會將於 2026 年 10 月 20 日至 21 日在倫敦奧林匹亞展覽中心舉行。圖片來源:BizClikAI LIVE:倫敦峰會匯聚全球領袖,共同解決營運瓶頸,並推動人工智慧在工業自動化領域的廣泛應用。工業效率的主要限制在於現有企業系統之間的手動交接。Ace Workflow 的最新數據顯示,透過針對性的自動化,可回收 26% 的記錄在案企業工時——而在財務部門,這一比例甚至
谷歌的 Genie 世界模型現在能夠模擬真實的街道,並整合街景功能
我們大多數人都曾使用 Google 街景向朋友展示我們以前的社羣,或者將那個小人圖示拖到巴黎,以檢查我們的酒店是否位於時尚區域。現在,想象一下以完全沉浸和互動的方式體驗這一功能——模擬街道及其周邊環境,調整天氣狀況,甚至視覺化“後天”中的極端場景。這正是 Google 最新整合背後的願景。從今天開始,Google DeepMind 將街景與 Project Genie 連結起來,後者是一個通用世界模型,能夠生成多樣化的互動式環境。該功能在 Google I/O 開發者大會上首次亮相。“這對於





首頁






