當今零售商積極考慮使用新工具來提高營運效率,並迎合消費者所期望的個人化購物體驗。事實上,根據我們兩週前發布的研究報告指出,81% 的美國零售業決策者認為,採用生成式 AI 刻不容緩。
僅僅一年時間,生成式 AI 已經從鮮為人知的概念,搖身一變成為所有科技領域中快速成長的技術之一,更成為許多零售商討論的關鍵議題。憑藉著生成式 AI 解決方案能加速企業成長、提升生產效率、推動創新並減少瑣碎的維運工作,加上目前已發展成熟可供部署,相信 Google Cloud 最近的創新成果可以幫助零售商在 2024 年感受其價值所在,開創新機遇
全新生成式 AI 和大型語言模型(LLM)功能 建立個人化且實用的線上購物體驗
Google 在上週正式發布了我們至今功能最強大、最具彈性的 AI 模型 Gemini。 Gemini 共有三種不同的規模:Ultra、Pro 以及 Nano。今天,我們很高興宣布 Gemini Pro 現在起可在我們的終端 AI 平台 Vertex AI 上使用。Vertex AI 是我們端對端 AI 平台,包含直覺式工具、完全代管的基礎架構和內建的隱私權及安全性功能。開發人員將可以使用 Gemini Pro 打造可以處理資訊並根據資訊採取行動的「輔助專員(agents)」
Vertex AI 可供開發人員自訂 Gemini 並部署到實際工作環境,協助他們設計全新且與眾不同的應用程式解讀文字、語言、程式碼、圖片與影片。透過 Vertex AI,開發人員能夠做到:
探索並使用 Gemini Pro,或選擇使用超過 130 個精心挑選的 Google 自家開發模型、開放原始碼或第三方模型,這些模型符合 Google 嚴格的企業安全與品質標準。開發人員可輕鬆存取這些模型以快速將他們建構於應用程式中。
利用特定領域或企業專業知識來客製化模型行為,並搭配微調工具擴增訓練知識,或在必要時調整模型權重(model weights)。Vertex AI 提供多種微調技術,包括指令設定(prompt design)、基於適配器式(adapter-based)的微調,例如 LoRA(Low Rank Adaptation)技術,以及萃取技術(Distillation)。此外,我們支援「人類回饋增強學習」(RLHF)技術,來捕捉使用者回饋,讓模型更加完善。
運用工具擴增模型,幫助 Gemini Pro 適應特定情境用途。開發人員可使用 Vertex AI 擴充功能和連接器將 Gemini Pro 與外部 API 連結,以進行交易和其他動作、檢索外部資料,或從程式碼庫中呼叫函數。Vertex AI 也能讓公司依照自家資料來源產出基礎模型內容,協助提升模型答案的準確性與相關性。我們支援企業透過 Google 搜尋技術,根據結構化與非結構化資料,產出切題的內容。
生成式 AI 模型正在迅速進化,並提供無可比擬的精密性與功能。這項技術進展得以讓各產業的企業與開發人員解決複雜的問題,並發掘新商機。不過生成式 AI 模型的成長,也導致訓練、調整與推論方面的要求變得更加嚴苛。過去五年來,生成式 AI 模型的參數每年增加十倍,現今的大型模型具有數千億、甚至數兆項參數,即便使用最專門的系統,仍需要相當長的訓練時間,有時需持續數月才能完成。此外,高效率的 AI 工作負載管理需要一個具備一致性、且由最佳化的運算、儲存、網路、軟體和開發框架所組成的整合式 AI 堆疊。
為解決這些難題,今天我們很高興宣布推出 Cloud TPU v5p,這是 Google 目前功能最強大、擴充能力最佳,且最具有彈性的 AI 加速器。長久以來,TPU 一直是用來訓練、服務 AI 支援的產品之基礎,這類產品包含 YouTube、Gmail、Google 地圖、Google Play 及 Android。事實上,Google 日前宣布推出功能最強大、最通用的 AI 模型 Gemini 便是使用 TPU 進行訓練與服務。
此外,我們也宣布推出 Google Cloud AI Hypercomputer。AI Hypercomputer 是 Google Cloud 的突破性超級電腦架構,採用整合式系統,並結合了效能最佳化硬體、開放式軟體、領先機器學習架構及靈活彈性的消費模式。傳統上通常是以零碎的方式,在元件層級進行增強以處理要求嚴苛的 AI 工作負載需求,而這可能導致效率不佳,或出現瓶頸。相較之下,AI Hypercomputer 採用系統層級的協同設計來提升 AI 訓練、調整與服務的效率與生產力。
上個月,我們宣布全面推出 Cloud TPU v5e。相較於上一代的 TPU v4,Cloud TPU v5e 的性價比提高了 2.3 倍,是我們目前最具成本效益的 TPU。而 Cloud TPU v5p,則是我們目前功能最強大的 TPU。每個 TPU v5p Pod 均由 8,960 個晶片組成,透過 我們頻寬最高的晶片間互連網路(Inter-chip Interconnect, ICI)相連,採用 3D 環面拓撲,提供每晶片 4,800 Gbps 的速度。相較於 TPU v4,TPU v5p 每秒的浮點運算次數(FLOPS)提高 2 倍以上,高頻寬記憶體(High-bandwidth Memory, HBM)則增加 3 倍。
TPU v5p 專為效能、彈性與大規模作業而設計,相較於前一代的 TPU v4,TPU v5p 訓練大型 LLM 模型的速度提升 2.8 倍。不僅如此,若搭配第二代 SparseCores,TPU v5p 訓練嵌入密集模型的速度較 TPU v4 快 1.9 倍[1]。
資料來源:Google 內部資料,截至 2023 年 11 月, GPT3-175B的所有數據均以晶片為單位完成標準化作業
我們很高興在今天的「Google Cloud Summit Taipei」雲端高峰會上,分享雲端科技對於台灣產業轉型的助益、慶祝 Google Cloud 雲端區域(Cloud Region)在台建置十周年,為台灣企業提供穩定與安全的網路基礎建設與雲端服務外,更與我們的產業合作夥伴,一同分享與探討如何透過雲端與人工智慧(AI)技術賦能企業雲端轉型,並在創新金融服務、AI 醫療輔助、AI 零售新商模、虛擬主播擬真互動、以及引領全球的半導體 AI 晶片設計等不同產業應用帶來的變革與創新契機。
我們作為最早提供在地業者大型基礎建設的公有雲供應商,過去十年來,透過穩定與安全的雲端區域 (Cloud Region) 、各種雲端科技與解決方案,洞察當地企業需求,協助台灣企業面對數位轉型挑戰,強化營運體質、提升市場競爭力。
近一年多 AI 科技的突破,更為企業迎來革新的絕佳契機, 而我們先進的 AI 技術,得以賦能台灣企業引領產業創新。對於台灣政府、產業合作夥伴以及雲端生態系夥伴多年來的支持與肯定,表達最深切的感謝。我們將持續與以上各單位共同努力,協助台灣企業打造數位韌性,邁向永續經營目標,並助力台灣成為亞洲矽谷。
永續發展是一個關鍵的企業議題,涵蓋氣候變遷、潔淨空氣、法規遵循和品牌誠信等各個層面。繼去年我們進行第一年的「Google Cloud 永續調查報告」中看出,台灣企業視永續為組織發展優先任務之一。今年,我們持續針對橫跨全球 16 個國家、共 1,476 位高階主管進行第二年的永續發展問卷調查,結果顯示企業往往會因資源減少,讓永續發展的推動更不可控,使「執行力」成為永續發展當前的新瓶頸。如果高階主管未能採取行動,例如推動當責文化、改善評估和管理機制,以及明確界定主管要務等,情況將隨著過去存在的風險變得更為嚴峻。