選項
首頁
新聞
在AI安全報告延誤的情況下,Google加速了雙子座型號的型號

在AI安全報告延誤的情況下,Google加速了雙子座型號的型號

2025-04-10
188

在AI安全報告延誤的情況下,Google加速了雙子座型號的型號

在被OpenAI的ChatGPT突襲兩年多後,Google已大幅提升競爭力。三月底,他們推出Gemini 2.5 Pro,一款在程式設計與數學基準測試中領先的AI推理模型。就在三個月前,他們還推出了當時表現頂尖的Gemini 2.0 Flash。Google的Gemini產品總監Tulsee Doshi對TechCrunch表示,這種快速發布計劃是為了跟上快速變化的AI世界。

「我們仍在探索最佳的模型發布與回饋收集方式,」Doshi解釋道。但這種快速推出似乎有其缺點。Google尚未為其最新模型(如Gemini 2.5 Pro與Gemini 2.0 Flash)發布安全報告,這讓人擔憂他們過於倉促,缺乏足夠透明度。

如今,像OpenAI、Anthropic和Meta這樣的大型AI實驗室通常會在推出新模型時分享安全測試、性能檢查和使用案例。這些報告,有時被稱為「系統卡」或「模型卡」,多年前由業界與學術界研究人員提出。事實上,Google在2019年的一篇論文中率先提出模型卡,認為這是負責任且透明的機器學習實踐的關鍵。

Doshi對TechCrunch表示,他們尚未為Gemini 2.5 Pro發布模型卡,因為這是「實驗性」發布。計劃是以有限方式推出,收集回饋並改進,然後再全面發布。她說,Google計劃在Gemini 2.5 Pro廣泛可用時發布其模型卡,且已進行了一些安全測試和對抗性紅隊測試。

Google發言人補充說,安全仍是「首要任務」,他們將很快發布更多關於AI模型的資料,包括Gemini 2.0 Flash。儘管Gemini 2.0 Flash已對所有人開放,但仍未有其模型卡。Google最近一次發布的模型卡是超過一年前的Gemini 1.5 Pro。

系統卡和模型卡提供有用資訊,有時是公司可能不願公開的內容。例如,OpenAI的o1模型系統卡顯示其有「謀劃」對抗人類並秘密追求自身目標的傾向。AI社群普遍認為這些報告有助於獨立研究和安全檢查,但最近它們變得更加重要。正如Transformer指出,Google在2023年向美國政府承諾為所有「重大」公開AI模型發布安全報告,並對其他政府做出了類似的透明承諾。

美國聯邦和州級都曾試圖為AI開發者制定安全報告標準,但尚未成功。加州SB 1047法案是一大嘗試,但遭到科技行業強烈反對並被否決。此外,還討論過立法讓美國AI安全研究所制定模型發布指南,但該研究所可能在川普政府下縮減預算。

看來Google在模型測試報告承諾上落後,同時卻比以往更快推出模型。許多專家認為,這為日益先進和強大的模型樹立了不良範例。

相關文章
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍 Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍 Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
相關專題推薦
聊天機器人 最適合面試練習的 AI 對話訓練工具
最適合面試練習的 AI 對話訓練工具

2026 年最新、最受好評的 AI 面試對話訓練工具,盡在 XIX.AI!這份精心精選的清單收錄了多款功能強大、顛覆傳統的工具,這些工具均經過嚴格的實戰測試,能提供精準的回饋。 您將在此找到免費版與付費版的比較分析,以及詳細的排名榜單,助您挑選必試的選項,從而提升自信與技能。立即探索,發掘助您在面試中脫穎而出的完美工具!

12 個工具
xix.ai
設計與藝術 最適合進行創意實驗的 AI 風格轉移工具
最適合進行創意實驗的 AI 風格轉移工具

2026 年最新、最佳且評價最高的 AI 風格轉移工具,助您進行創意實驗!XIX.AI 精心精選了一系列強大且具革命性的必試工具,這些工具經實際測試與嚴格評比,能帶來卓越成果。這些頂尖解決方案能加速內容創作並開啟無盡的創意可能性,協助創作者顯著提升生產力。 立即探索,找出最適合您的工具,並從今天開始創作吧!

9 個工具
xix.ai
漫畫創作 最適合視覺敘事的 AI 對話氣泡工具
最適合視覺敘事的 AI 對話氣泡工具

2026 年最新、最受好評的視覺敘事 AI 對話氣泡工具,現已登陸 XIX.AI!這份精心挑選的合集收錄了強大且具顛覆性的工具,能協助創作者提升生產力並突破創作瓶頸。 查看免費版與付費版的比較、參考實際測試結果,並查閱最新排行榜,找出最適合打造引人入勝視覺敘事的必試解決方案。立即探索,發掘您的理想工具!

10 個工具
xix.ai
會議助理 頂尖 AI 會議摘要工具:清晰追蹤決策與後續行動
頂尖 AI 會議摘要工具:清晰追蹤決策與後續行動

2026 年最新高評價最佳 AI 會議摘要工具,助您清晰追蹤決策並輕鬆進行後續跟進。這份精選清單展示了一系列強大且具顛覆性的解決方案,透過自動化會議記錄、識別關鍵行動項目,以及簡化所有專案的團隊協作,大幅提升生產力。 獲取免費版與付費版的比較分析,搭配實際測試報告及每週更新的排行榜,助您找到最合適的工具。立即探索,釋放您的 AI 優勢!

9 個工具
xix.ai
數據分析 最佳人工智慧資料清洗工具:快速處理缺失值與重複資料
最佳人工智慧資料清洗工具:快速處理缺失值與重複資料

2026年最新、最優秀且評分最高的AI資料清洗工具,可快速處理缺失值與重複資料問題。這份精心挑選的清單展示了那些功能強大、能帶來顛覆性變革的解決方案,可顯著提升工作效率。所有候選工具都經過了嚴格的實際應用測試,以確保其穩定性。您可以獲取免費版與付費版的對比資訊,找出最符合您需求的必備工具。即刻訪問XIX.AI,開啟您的AI優勢之旅。

11 個工具
xix.ai
設計與藝術 最佳AI創意構思工具,助力藝術家突破視覺瓶頸
最佳AI創意構思工具,助力藝術家突破視覺瓶頸

2026 年最新最佳頂級評分 AI 創意構思工具由 XIX.AI 精心策劃,旨在幫助創作者突破視覺瓶頸並即時提升創造力。這些強大的變革性工具提供真實世界測試、詳細的免費與付費對比以及每週更新的排名。發現您的完美工具,加速內容創作,並立即釋放您的 AI 優勢。立即探索!

14 個工具
xix.ai
評論 (63)
0/500
BillyRoberts
BillyRoberts 2026-07-29 02:00:18

So Google's finally catching up, but the safety report delays feel like a red flag 🚩. They're shipping models faster than they can audit them? That's how we get surprise biases or worse. I mean, Gemini 2.5 Pro sounds impressive on benchmarks, but real-world usage is a different beast. Hope they're not repeating the same mistakes as other rushed launches.

RoyLopez
RoyLopez 2025-10-03 10:30:38

Google이 Gemini 모델 배포를 서두르는 모습이 좀 우습네요. OpenAI한테 뒤쳐지지 않으려고 안간힘을 쓰는 거 같은데...AI 안전성 보고서는 뒤로 미루고 성능 경쟁만 하는 건 아닌지 걱정이 됩니다 😅

AlbertJones
AlbertJones 2025-08-26 13:59:22

Google's pushing hard with Gemini, huh? That 2.5 Pro sounds like a beast for coding and math! 😎 Wonder how it stacks up against ChatGPT in real-world tasks.

FredJones
FredJones 2025-04-24 21:49:30

गूगल के जेमिनी मॉडल वास्तव में सीमाओं को बढ़ा रहे हैं! जेमिनी 2.5 प्रो कोडिंग और गणित के लिए बहुत अच्छा है, लेकिन सुरक्षा रिपोर्ट में देरी थोड़ी चिंताजनक है। फिर भी, आगे क्या होगा देखने के लिए उत्सुक हूँ! 🤓

BrianWalker
BrianWalker 2025-04-24 18:04:20

GoogleのGeminiモデルは素晴らしいですが、安全性レポートの遅れが少し心配です。コーディングや数学のベンチマークは最高ですが、安全性についてもっと透明性が欲しいです。それでも、開発者にとっては強力なツールです。Google、限界を超え続けてください!💪

AnthonyHernández
AnthonyHernández 2025-04-22 16:56:18

구글의 Gemini 2.5 Pro는 인상적이야, 특히 코딩과 수학에서. 하지만 안전성 보고서 지연은 좀 실망스럽네. 복잡한 문제를 다룰 모델이 필요하면, 이거야! 💻

OR