打開深搜索到達以挑戰困惑和chatgpt搜索
如果您身處科技界,您可能已聽說過來自Sentient基金會的新開源框架Open Deep Search(ODS)所引發的熱議。ODS正掀起波瀾,作為Perplexity和ChatGPT Search等專有AI搜尋引擎的強大替代方案,它專注於賦能大型語言模型(LLMs),透過先進的推理代理,利用網路搜尋和其他工具有效回答您的查詢。
AI搜尋格局
當今的AI搜尋工具,如Perplexity和ChatGPT Search,令人印象深刻,它們結合了LLMs的知識和推理能力以及即時網路搜尋,提供最新的答案。然而,這些系統往往被鎖在專有大門後,這使得自訂化和專業應用成為挑戰。
Sentient共同創辦人Himanshu Tyagi在接受VentureBeat採訪時表示:「AI搜尋的創新大多數在閉門造車中進行。開源的努力在可用性和性能上歷來落後。ODS旨在彌合這一差距,證明開源系統不僅能與封閉系統競爭,甚至在品質、速度和靈活性上可能超越對方。」
Open Deep Search(ODS)架構
ODS不僅僅是一個工具;它是一個即插即用的系統,可與DeepSeek-R1等開源模型以及GPT-4o和Claude等閉源模型整合。其核心包含兩個主要組件:
開放搜尋工具
此組件接收您的查詢,並在網路上搜索相關資訊,作為LLM的背景資料。它也很聰明——會以多種方式重新表述您的查詢,以確保廣泛且多樣化的搜尋。在從搜尋引擎獲取結果後,它提取片段和連結頁面,然後使用分塊和重新排序來鎖定最相關的內容。它特別擅長處理Wikipedia、ArXiv和PubMed等特定來源,並可在面對矛盾資訊時被提示優先考慮可靠來源。

開放推理代理
此代理接收您的查詢,結合基礎LLM和各種工具(包括開放搜尋工具)來生成最終答案。Sentient在ODS中提供了兩種不同的代理架構:
ODS-v1
此版本結合了ReAct代理框架和Chain-of-Thought(CoT)推理。ReAct代理在推理步驟(「思考」)、行動(如使用搜尋工具)和觀察(行動結果)之間交替進行。ODS-v1透過此過程迭代以得出答案。如果ReAct代理遇到問題,它會回退到CoT自我一致性,採樣多個CoT回應並選擇最常見的答案。
ODS-v2
此版本採用Chain-of-Code(CoC)和基於Hugging Face SmolAgents庫的CodeAct代理。CoC利用LLM生成和執行程式碼片段來解決問題,而CodeAct則使用程式碼生成來規劃行動。ODS-v2能管理多個工具和代理,非常適合處理需要複雜規劃和多次搜尋迭代的任務。
ODS架構來源:arXiv
Tyagi解釋說:「雖然像ChatGPT或Grok這樣的工具透過對話代理提供『深度研究』,但ODS的運作層次不同——更像是Perplexity AI背後的基礎架構——提供支持智能檢索的底層架構,而不僅僅是摘要。」
性能與實際成果
Sentient將ODS與開源DeepSeek-R1模型結合,與Perplexity AI和OpenAI的GPT-4o Search Preview等閉源競爭對手,以及GPT-4o和Llama-3.1-70B等獨立LLMs進行對比測試。他們使用了FRAMES和SimpleQA基準,經過調整以評估啟用搜尋的AI系統的準確性。
結果令人印象深刻。ODS-v1和ODS-v2與DeepSeek-R1搭配時,超越了Perplexity的旗艦產品。ODS-v2與DeepSeek-R1甚至在複雜的FRAMES基準上超越了GPT-4o Search Preview,並在SimpleQA上表現接近。

一個有趣的見解是該框架的效率。兩版本ODS的推理代理學會了明智地使用搜尋工具,根據初始結果的品質判斷是否需要進一步搜尋。例如,ODS-v2在較簡單的SimpleQA任務上使用較少的網路搜尋,而在FRAMES的多跳查詢中則使用更多,優化了資源使用。
對企業的影響
對於希望利用強大的AI推理能力和即時資訊的企業來說,ODS是一個改變遊戲規則的工具。它提供了一個透明、可自訂且高效能的替代方案,取代專有AI搜尋系統。能夠插入首選的開源LLMs和工具,意味著組織可以量身打造其AI堆疊,避免被鎖定在單一供應商中。
Tyagi指出:「ODS的設計考慮了模組化。它根據提示中提供的描述動態選擇使用哪些工具。這意味著只要工具描述良好,它就能流暢地與不熟悉的工具互動,而無需事先接觸。」
然而,他也警告說,如果工具集過於雜亂,ODS的性能可能會下降,「因此謹慎的設計至關重要。」
Sentient已在GitHub上公開了ODS程式碼,邀請社群探索和貢獻。
Tyagi總結說:「最初,Perplexity和ChatGPT的優勢在於其先進技術,但有了ODS,我們已拉平了這一技術競爭場。我們現在的目標是透過『開放輸入和開放輸出』策略,超越它們的能力,讓使用者能無縫整合自訂代理到Sentient Chat中。」
相關文章
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
佛羅里達州就暴力事件起訴 OpenAI 和薩姆·阿爾特曼
佛羅里達州總檢察長於週一提起了一項史無前例的州級訴訟,起訴 OpenAI 及其執行長山姆·奧特曼(Sam Altman),指控該公司的 ChatGPT 與多起暴力事件有關。訴訟稱,OpenAI 優先考慮贏得“人工智慧軍備競賽並積累鉅額財富”,而忽視了安全問題。“今天我們宣佈了對 OpenAI 及其執行長山姆·奧特曼提起的首個全州性訴訟,”佛羅里達州總檢察長詹姆斯·烏特邁爾(James Uthmeier)表示。“OpenAI 和奧特曼無視內部和外部的安全警告,使兒童面臨巨大風險,並允許
Base44 推出專有 AI 模型,以增強其 Vibe Coding 平臺的安全性
Base44,這個一年前僅成立六個月、團隊規模僅為八人的初創公司,被Wix以8000萬美元收購,如今已開始部署其專有AI模型,幫助使用者使用自然語言構建應用程式。這一進展正值AI社羣爭論前沿模型是否適用於所有用例,以及依賴外部模型的企業能否保持長期競爭優勢之時。總部位於灣區的Base44的最新戰略旨在解決這兩方面的擔憂。儘管其定製大語言模型(LLM)剛剛推出,Base44的目標是最終超越前沿模型。創始人Maor Shlomo指出,“作為我們整個技術棧的一部分來訓練並擁有該模型,使我們能夠在延遲
相關專題推薦
評論 (2)
0/500
¿ODS realmente puede competir con los gigantes? Me encanta la idea de código abierto, pero ¿será lo suficientemente rápido y preciso para el uso diario? 🤔 Espero que no sea solo otro proyecto prometedor que se queda en el camino. ¡Cruzo los dedos!
如果您身處科技界,您可能已聽說過來自Sentient基金會的新開源框架Open Deep Search(ODS)所引發的熱議。ODS正掀起波瀾,作為Perplexity和ChatGPT Search等專有AI搜尋引擎的強大替代方案,它專注於賦能大型語言模型(LLMs),透過先進的推理代理,利用網路搜尋和其他工具有效回答您的查詢。
AI搜尋格局
當今的AI搜尋工具,如Perplexity和ChatGPT Search,令人印象深刻,它們結合了LLMs的知識和推理能力以及即時網路搜尋,提供最新的答案。然而,這些系統往往被鎖在專有大門後,這使得自訂化和專業應用成為挑戰。
Sentient共同創辦人Himanshu Tyagi在接受VentureBeat採訪時表示:「AI搜尋的創新大多數在閉門造車中進行。開源的努力在可用性和性能上歷來落後。ODS旨在彌合這一差距,證明開源系統不僅能與封閉系統競爭,甚至在品質、速度和靈活性上可能超越對方。」
Open Deep Search(ODS)架構
ODS不僅僅是一個工具;它是一個即插即用的系統,可與DeepSeek-R1等開源模型以及GPT-4o和Claude等閉源模型整合。其核心包含兩個主要組件:
開放搜尋工具
此組件接收您的查詢,並在網路上搜索相關資訊,作為LLM的背景資料。它也很聰明——會以多種方式重新表述您的查詢,以確保廣泛且多樣化的搜尋。在從搜尋引擎獲取結果後,它提取片段和連結頁面,然後使用分塊和重新排序來鎖定最相關的內容。它特別擅長處理Wikipedia、ArXiv和PubMed等特定來源,並可在面對矛盾資訊時被提示優先考慮可靠來源。

開放推理代理
此代理接收您的查詢,結合基礎LLM和各種工具(包括開放搜尋工具)來生成最終答案。Sentient在ODS中提供了兩種不同的代理架構:
ODS-v1
此版本結合了ReAct代理框架和Chain-of-Thought(CoT)推理。ReAct代理在推理步驟(「思考」)、行動(如使用搜尋工具)和觀察(行動結果)之間交替進行。ODS-v1透過此過程迭代以得出答案。如果ReAct代理遇到問題,它會回退到CoT自我一致性,採樣多個CoT回應並選擇最常見的答案。
ODS-v2
此版本採用Chain-of-Code(CoC)和基於Hugging Face SmolAgents庫的CodeAct代理。CoC利用LLM生成和執行程式碼片段來解決問題,而CodeAct則使用程式碼生成來規劃行動。ODS-v2能管理多個工具和代理,非常適合處理需要複雜規劃和多次搜尋迭代的任務。
ODS架構來源:arXiv
Tyagi解釋說:「雖然像ChatGPT或Grok這樣的工具透過對話代理提供『深度研究』,但ODS的運作層次不同——更像是Perplexity AI背後的基礎架構——提供支持智能檢索的底層架構,而不僅僅是摘要。」
性能與實際成果
Sentient將ODS與開源DeepSeek-R1模型結合,與Perplexity AI和OpenAI的GPT-4o Search Preview等閉源競爭對手,以及GPT-4o和Llama-3.1-70B等獨立LLMs進行對比測試。他們使用了FRAMES和SimpleQA基準,經過調整以評估啟用搜尋的AI系統的準確性。
結果令人印象深刻。ODS-v1和ODS-v2與DeepSeek-R1搭配時,超越了Perplexity的旗艦產品。ODS-v2與DeepSeek-R1甚至在複雜的FRAMES基準上超越了GPT-4o Search Preview,並在SimpleQA上表現接近。

一個有趣的見解是該框架的效率。兩版本ODS的推理代理學會了明智地使用搜尋工具,根據初始結果的品質判斷是否需要進一步搜尋。例如,ODS-v2在較簡單的SimpleQA任務上使用較少的網路搜尋,而在FRAMES的多跳查詢中則使用更多,優化了資源使用。
對企業的影響
對於希望利用強大的AI推理能力和即時資訊的企業來說,ODS是一個改變遊戲規則的工具。它提供了一個透明、可自訂且高效能的替代方案,取代專有AI搜尋系統。能夠插入首選的開源LLMs和工具,意味著組織可以量身打造其AI堆疊,避免被鎖定在單一供應商中。
Tyagi指出:「ODS的設計考慮了模組化。它根據提示中提供的描述動態選擇使用哪些工具。這意味著只要工具描述良好,它就能流暢地與不熟悉的工具互動,而無需事先接觸。」
然而,他也警告說,如果工具集過於雜亂,ODS的性能可能會下降,「因此謹慎的設計至關重要。」
Sentient已在GitHub上公開了ODS程式碼,邀請社群探索和貢獻。
Tyagi總結說:「最初,Perplexity和ChatGPT的優勢在於其先進技術,但有了ODS,我們已拉平了這一技術競爭場。我們現在的目標是透過『開放輸入和開放輸出』策略,超越它們的能力,讓使用者能無縫整合自訂代理到Sentient Chat中。」
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
佛羅里達州就暴力事件起訴 OpenAI 和薩姆·阿爾特曼
佛羅里達州總檢察長於週一提起了一項史無前例的州級訴訟,起訴 OpenAI 及其執行長山姆·奧特曼(Sam Altman),指控該公司的 ChatGPT 與多起暴力事件有關。訴訟稱,OpenAI 優先考慮贏得“人工智慧軍備競賽並積累鉅額財富”,而忽視了安全問題。“今天我們宣佈了對 OpenAI 及其執行長山姆·奧特曼提起的首個全州性訴訟,”佛羅里達州總檢察長詹姆斯·烏特邁爾(James Uthmeier)表示。“OpenAI 和奧特曼無視內部和外部的安全警告,使兒童面臨巨大風險,並允許
Base44 推出專有 AI 模型,以增強其 Vibe Coding 平臺的安全性
Base44,這個一年前僅成立六個月、團隊規模僅為八人的初創公司,被Wix以8000萬美元收購,如今已開始部署其專有AI模型,幫助使用者使用自然語言構建應用程式。這一進展正值AI社羣爭論前沿模型是否適用於所有用例,以及依賴外部模型的企業能否保持長期競爭優勢之時。總部位於灣區的Base44的最新戰略旨在解決這兩方面的擔憂。儘管其定製大語言模型(LLM)剛剛推出,Base44的目標是最終超越前沿模型。創始人Maor Shlomo指出,“作為我們整個技術棧的一部分來訓練並擁有該模型,使我們能夠在延遲
¿ODS realmente puede competir con los gigantes? Me encanta la idea de código abierto, pero ¿será lo suficientemente rápido y preciso para el uso diario? 🤔 Espero que no sea solo otro proyecto prometedor que se queda en el camino. ¡Cruzo los dedos!





首頁






