Google揭露了雙子座:有關新AI模型的關鍵事實

Google Gemini 是由 Google 及其母公司 Alphabet 開發的尖端人工智能模型。此模型以其多模態能力脫穎而出,意味著它能處理並理解多種數據類型,包括文字、圖像、影片和音頻。它被設計用於處理數學、物理和程式設計等領域的複雜任務,能生成多種語言的高品質程式碼。
Gemini 可透過 Gemini 聊天機器人存取,該聊天機器人之前稱為 Google Bard,並已整合至某些 Google Pixel 設備中。Google 計劃進一步將 Gemini 整合至其服務套件中,包括搜尋、廣告、Chrome 等。在 2024 年 Google I/O 活動中,宣佈了新功能,如「Live」模式以及與 Project Astra 的整合,展示了 Gemini 不斷進化的能力。
Gemini 的開發涉及 Google 內部的廣泛合作,包括 Google DeepMind 的重大貢獻。Google DeepMind 的首席執行官兼聯合創始人 Dennis Hassabis 強調,Gemini 從頭開始建構為多模態,使其能無縫理解並操作不同類型的信息。
為了滿足不同需求和設備,Gemini 提供多個版本:
- Gemini Nano 1.0:專為智能手機設計,如 Google Pixel 8,能高效執行設備端 AI 任務,擁有 32,000 個 token 的上下文窗口。
- Gemini Flash 1.5:輕量級模型,專注於速度和成本效益,擁有 100 萬個 token 的上下文窗口,能處理大量內容,如一小時的影片或超過 30,000 行的程式碼。
- Gemini Pro 1.5:為 Gemini Advanced 聊天機器人提供動力,運行於 Google 的數據中心,擁有 200 萬個 token 的上下文窗口,是大規模模型中可用的最長窗口。
- Gemini Ultra 1.0:Google 最強大的模型,在 32 個廣泛使用的學術基準中有 30 個表現出色。可透過 Vertex AI 和 Google AI Studio 的 Gemini API 存取。
您可以透過訪問 Gemini.Google.com 或透過整合的 Google 產品(如 Android 設備、Gemini 移動應用程式、Google Photos 等)與 Gemini 互動。開發者和企業用戶可透過 Google 的 AI Studio 和 Google Cloud Vertex AI 的 Gemini API 存取 Gemini Ultra,而 Android 開發者可透過 AICore 使用 Gemini Nano。
與其他 AI 模型如 GPT-4 相比,Gemini 以其原生多模態處理和長上下文窗口而著稱。雖然 GPT-4 主要專注於文字並使用外掛程式處理其他數據類型,但 Gemini 原生處理多種數據類型。此外,Gemini 更注重產品整合,融入 Google 生態系統,而像 GPT-4 和 Meta 的 Llama 等模型則常用於第三方應用程式和服務。
[ttpp]
[yyxx]
相關文章
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
相關專題推薦
評論 (17)
0/500
Gemini klingt beeindruckend, aber ich frage mich, wie es sich in der Praxis gegen GPT-4 schlagen wird. Die Multimodalität ist natürlich ein großer Schritt, aber bei Google-Produkten dauert es oft ewig, bis sie für normale Nutzer wirklich zugänglich sind. Hoffentlich wird es nicht nur ein weiteres Demo-Projekt, das dann in der Schublade verschwindet. 🤔
Gemini's multimodal capabilities sound impressive! 😮 I wonder how it compares to other AI models in real-world tasks like video analysis or creative content generation. Can't wait to see it in action!
O modelo de IA Gemini do Google parece super avançado com suas capacidades multimodais! É legal que ele possa lidar com texto, imagens, vídeos e áudio ao mesmo tempo. Mas, será que é um exagero para o uso diário? Ainda assim, é uma tecnologia impressionante! 🤖
El modelo de IA Gemini de Google suena súper avanzado con sus capacidades multimodales. ¡Es genial que pueda manejar texto, imágenes, videos y audio al mismo tiempo! Pero, ¿será demasiado para el uso diario? Aún así, es una tecnología impresionante. 🤖
구글의 제미니 AI 모델은 멀티모달 기능이 정말 발전된 것 같아요! 텍스트, 이미지, 비디오, 오디오를 한꺼번에 처리할 수 있다니 멋지네요. 하지만 일상적인 사용에는 과하지 않을까요? 그래도 인상적인 기술이에요! 🤖

Google Gemini 是由 Google 及其母公司 Alphabet 開發的尖端人工智能模型。此模型以其多模態能力脫穎而出,意味著它能處理並理解多種數據類型,包括文字、圖像、影片和音頻。它被設計用於處理數學、物理和程式設計等領域的複雜任務,能生成多種語言的高品質程式碼。
Gemini 可透過 Gemini 聊天機器人存取,該聊天機器人之前稱為 Google Bard,並已整合至某些 Google Pixel 設備中。Google 計劃進一步將 Gemini 整合至其服務套件中,包括搜尋、廣告、Chrome 等。在 2024 年 Google I/O 活動中,宣佈了新功能,如「Live」模式以及與 Project Astra 的整合,展示了 Gemini 不斷進化的能力。
Gemini 的開發涉及 Google 內部的廣泛合作,包括 Google DeepMind 的重大貢獻。Google DeepMind 的首席執行官兼聯合創始人 Dennis Hassabis 強調,Gemini 從頭開始建構為多模態,使其能無縫理解並操作不同類型的信息。
為了滿足不同需求和設備,Gemini 提供多個版本:
- Gemini Nano 1.0:專為智能手機設計,如 Google Pixel 8,能高效執行設備端 AI 任務,擁有 32,000 個 token 的上下文窗口。
- Gemini Flash 1.5:輕量級模型,專注於速度和成本效益,擁有 100 萬個 token 的上下文窗口,能處理大量內容,如一小時的影片或超過 30,000 行的程式碼。
- Gemini Pro 1.5:為 Gemini Advanced 聊天機器人提供動力,運行於 Google 的數據中心,擁有 200 萬個 token 的上下文窗口,是大規模模型中可用的最長窗口。
- Gemini Ultra 1.0:Google 最強大的模型,在 32 個廣泛使用的學術基準中有 30 個表現出色。可透過 Vertex AI 和 Google AI Studio 的 Gemini API 存取。
您可以透過訪問 Gemini.Google.com 或透過整合的 Google 產品(如 Android 設備、Gemini 移動應用程式、Google Photos 等)與 Gemini 互動。開發者和企業用戶可透過 Google 的 AI Studio 和 Google Cloud Vertex AI 的 Gemini API 存取 Gemini Ultra,而 Android 開發者可透過 AICore 使用 Gemini Nano。
與其他 AI 模型如 GPT-4 相比,Gemini 以其原生多模態處理和長上下文窗口而著稱。雖然 GPT-4 主要專注於文字並使用外掛程式處理其他數據類型,但 Gemini 原生處理多種數據類型。此外,Gemini 更注重產品整合,融入 Google 生態系統,而像 GPT-4 和 Meta 的 Llama 等模型則常用於第三方應用程式和服務。
[ttpp]
[yyxx]
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
Gemini klingt beeindruckend, aber ich frage mich, wie es sich in der Praxis gegen GPT-4 schlagen wird. Die Multimodalität ist natürlich ein großer Schritt, aber bei Google-Produkten dauert es oft ewig, bis sie für normale Nutzer wirklich zugänglich sind. Hoffentlich wird es nicht nur ein weiteres Demo-Projekt, das dann in der Schublade verschwindet. 🤔
Gemini's multimodal capabilities sound impressive! 😮 I wonder how it compares to other AI models in real-world tasks like video analysis or creative content generation. Can't wait to see it in action!
O modelo de IA Gemini do Google parece super avançado com suas capacidades multimodais! É legal que ele possa lidar com texto, imagens, vídeos e áudio ao mesmo tempo. Mas, será que é um exagero para o uso diário? Ainda assim, é uma tecnologia impressionante! 🤖
El modelo de IA Gemini de Google suena súper avanzado con sus capacidades multimodales. ¡Es genial que pueda manejar texto, imágenes, videos y audio al mismo tiempo! Pero, ¿será demasiado para el uso diario? Aún así, es una tecnología impresionante. 🤖
구글의 제미니 AI 모델은 멀티모달 기능이 정말 발전된 것 같아요! 텍스트, 이미지, 비디오, 오디오를 한꺼번에 처리할 수 있다니 멋지네요. 하지만 일상적인 사용에는 과하지 않을까요? 그래도 인상적인 기술이에요! 🤖





首頁






