Google揭露了雙子座:有關新AI模型的關鍵事實

Google Gemini 是由 Google 及其母公司 Alphabet 開發的尖端人工智能模型。此模型以其多模態能力脫穎而出,意味著它能處理並理解多種數據類型,包括文字、圖像、影片和音頻。它被設計用於處理數學、物理和程式設計等領域的複雜任務,能生成多種語言的高品質程式碼。
Gemini 可透過 Gemini 聊天機器人存取,該聊天機器人之前稱為 Google Bard,並已整合至某些 Google Pixel 設備中。Google 計劃進一步將 Gemini 整合至其服務套件中,包括搜尋、廣告、Chrome 等。在 2024 年 Google I/O 活動中,宣佈了新功能,如「Live」模式以及與 Project Astra 的整合,展示了 Gemini 不斷進化的能力。
Gemini 的開發涉及 Google 內部的廣泛合作,包括 Google DeepMind 的重大貢獻。Google DeepMind 的首席執行官兼聯合創始人 Dennis Hassabis 強調,Gemini 從頭開始建構為多模態,使其能無縫理解並操作不同類型的信息。
為了滿足不同需求和設備,Gemini 提供多個版本:
- Gemini Nano 1.0:專為智能手機設計,如 Google Pixel 8,能高效執行設備端 AI 任務,擁有 32,000 個 token 的上下文窗口。
- Gemini Flash 1.5:輕量級模型,專注於速度和成本效益,擁有 100 萬個 token 的上下文窗口,能處理大量內容,如一小時的影片或超過 30,000 行的程式碼。
- Gemini Pro 1.5:為 Gemini Advanced 聊天機器人提供動力,運行於 Google 的數據中心,擁有 200 萬個 token 的上下文窗口,是大規模模型中可用的最長窗口。
- Gemini Ultra 1.0:Google 最強大的模型,在 32 個廣泛使用的學術基準中有 30 個表現出色。可透過 Vertex AI 和 Google AI Studio 的 Gemini API 存取。
您可以透過訪問 Gemini.Google.com 或透過整合的 Google 產品(如 Android 設備、Gemini 移動應用程式、Google Photos 等)與 Gemini 互動。開發者和企業用戶可透過 Google 的 AI Studio 和 Google Cloud Vertex AI 的 Gemini API 存取 Gemini Ultra,而 Android 開發者可透過 AICore 使用 Gemini Nano。
與其他 AI 模型如 GPT-4 相比,Gemini 以其原生多模態處理和長上下文窗口而著稱。雖然 GPT-4 主要專注於文字並使用外掛程式處理其他數據類型,但 Gemini 原生處理多種數據類型。此外,Gemini 更注重產品整合,融入 Google 生態系統,而像 GPT-4 和 Meta 的 Llama 等模型則常用於第三方應用程式和服務。
[ttpp]
[yyxx]
相關文章
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代
Guident 在南佛羅里達州營運一輛 AuveTech 接駁車,並運用其遠端監控技術,管理西棕櫚灘的一條四英里路線以及博卡拉頓的一條一英里路線。| 圖片來源:Guident加州正重新定義無人駕駛車輛的監管格局,從科技產業的「快速行動、打破常規」心態,轉向嚴格的問責制與嚴謹的行駛里程要求。Guident 執行董事長兼執行長哈羅德·布勞恩(Harold Braun)在《機器人報告》(The Robo
相關專題推薦
評論 (17)
0/500
Gemini klingt beeindruckend, aber ich frage mich, wie es sich in der Praxis gegen GPT-4 schlagen wird. Die Multimodalität ist natürlich ein großer Schritt, aber bei Google-Produkten dauert es oft ewig, bis sie für normale Nutzer wirklich zugänglich sind. Hoffentlich wird es nicht nur ein weiteres Demo-Projekt, das dann in der Schublade verschwindet. 🤔
Gemini's multimodal capabilities sound impressive! 😮 I wonder how it compares to other AI models in real-world tasks like video analysis or creative content generation. Can't wait to see it in action!
O modelo de IA Gemini do Google parece super avançado com suas capacidades multimodais! É legal que ele possa lidar com texto, imagens, vídeos e áudio ao mesmo tempo. Mas, será que é um exagero para o uso diário? Ainda assim, é uma tecnologia impressionante! 🤖
El modelo de IA Gemini de Google suena súper avanzado con sus capacidades multimodales. ¡Es genial que pueda manejar texto, imágenes, videos y audio al mismo tiempo! Pero, ¿será demasiado para el uso diario? Aún así, es una tecnología impresionante. 🤖
구글의 제미니 AI 모델은 멀티모달 기능이 정말 발전된 것 같아요! 텍스트, 이미지, 비디오, 오디오를 한꺼번에 처리할 수 있다니 멋지네요. 하지만 일상적인 사용에는 과하지 않을까요? 그래도 인상적인 기술이에요! 🤖

Google Gemini 是由 Google 及其母公司 Alphabet 開發的尖端人工智能模型。此模型以其多模態能力脫穎而出,意味著它能處理並理解多種數據類型,包括文字、圖像、影片和音頻。它被設計用於處理數學、物理和程式設計等領域的複雜任務,能生成多種語言的高品質程式碼。
Gemini 可透過 Gemini 聊天機器人存取,該聊天機器人之前稱為 Google Bard,並已整合至某些 Google Pixel 設備中。Google 計劃進一步將 Gemini 整合至其服務套件中,包括搜尋、廣告、Chrome 等。在 2024 年 Google I/O 活動中,宣佈了新功能,如「Live」模式以及與 Project Astra 的整合,展示了 Gemini 不斷進化的能力。
Gemini 的開發涉及 Google 內部的廣泛合作,包括 Google DeepMind 的重大貢獻。Google DeepMind 的首席執行官兼聯合創始人 Dennis Hassabis 強調,Gemini 從頭開始建構為多模態,使其能無縫理解並操作不同類型的信息。
為了滿足不同需求和設備,Gemini 提供多個版本:
- Gemini Nano 1.0:專為智能手機設計,如 Google Pixel 8,能高效執行設備端 AI 任務,擁有 32,000 個 token 的上下文窗口。
- Gemini Flash 1.5:輕量級模型,專注於速度和成本效益,擁有 100 萬個 token 的上下文窗口,能處理大量內容,如一小時的影片或超過 30,000 行的程式碼。
- Gemini Pro 1.5:為 Gemini Advanced 聊天機器人提供動力,運行於 Google 的數據中心,擁有 200 萬個 token 的上下文窗口,是大規模模型中可用的最長窗口。
- Gemini Ultra 1.0:Google 最強大的模型,在 32 個廣泛使用的學術基準中有 30 個表現出色。可透過 Vertex AI 和 Google AI Studio 的 Gemini API 存取。
您可以透過訪問 Gemini.Google.com 或透過整合的 Google 產品(如 Android 設備、Gemini 移動應用程式、Google Photos 等)與 Gemini 互動。開發者和企業用戶可透過 Google 的 AI Studio 和 Google Cloud Vertex AI 的 Gemini API 存取 Gemini Ultra,而 Android 開發者可透過 AICore 使用 Gemini Nano。
與其他 AI 模型如 GPT-4 相比,Gemini 以其原生多模態處理和長上下文窗口而著稱。雖然 GPT-4 主要專注於文字並使用外掛程式處理其他數據類型,但 Gemini 原生處理多種數據類型。此外,Gemini 更注重產品整合,融入 Google 生態系統,而像 GPT-4 和 Meta 的 Llama 等模型則常用於第三方應用程式和服務。
[ttpp]
[yyxx]
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
Gemini klingt beeindruckend, aber ich frage mich, wie es sich in der Praxis gegen GPT-4 schlagen wird. Die Multimodalität ist natürlich ein großer Schritt, aber bei Google-Produkten dauert es oft ewig, bis sie für normale Nutzer wirklich zugänglich sind. Hoffentlich wird es nicht nur ein weiteres Demo-Projekt, das dann in der Schublade verschwindet. 🤔
Gemini's multimodal capabilities sound impressive! 😮 I wonder how it compares to other AI models in real-world tasks like video analysis or creative content generation. Can't wait to see it in action!
O modelo de IA Gemini do Google parece super avançado com suas capacidades multimodais! É legal que ele possa lidar com texto, imagens, vídeos e áudio ao mesmo tempo. Mas, será que é um exagero para o uso diário? Ainda assim, é uma tecnologia impressionante! 🤖
El modelo de IA Gemini de Google suena súper avanzado con sus capacidades multimodales. ¡Es genial que pueda manejar texto, imágenes, videos y audio al mismo tiempo! Pero, ¿será demasiado para el uso diario? Aún así, es una tecnología impresionante. 🤖
구글의 제미니 AI 모델은 멀티모달 기능이 정말 발전된 것 같아요! 텍스트, 이미지, 비디오, 오디오를 한꺼번에 처리할 수 있다니 멋지네요. 하지만 일상적인 사용에는 과하지 않을까요? 그래도 인상적인 기술이에요! 🤖





首頁






