事件總覽:Google旗下的生成式人工智慧模型Google Gemini近期迎來一系列重大功能更新與深度整合應用,從研究報告生成到辦公協作,全面強化其作為高效生產力工具的潛力。
📅 近期:生成式AI核心能力顯著提升
Google Gemini近期在核心的生成能力上實現顯著飛躍,使其在處理複雜任務時更具效率。根據《Fast Company Middle East》的報導,Gemini不僅能迅速產出全面的研究報告,更具備建構儀表板與製作資訊圖表的能力,大幅拓寬了其在數據視覺化與分析領域的應用範疇。其「深度研究」工具(Deep Research)能針對特定地點、人物、事件或技術等主題,依據用戶指定的用途、理解程度、偏好來源與風格(如表格、條列、圖表)生成詳盡報告,展現其強大的資訊彙整能力。此外,Google Gemini的上下文視窗高達一百萬個tokens,這意味著它每次查詢可吸收並處理約1,500頁的文字內容,為用戶進行大規模資料分析提供了前所未有的彈性與深度。
在內容生成方面,Google Gemini的圖像生成功能亦大幅進化,能協助用戶製作簡報圖表、說明性圖片或社論漫畫。有趣的是,它甚至能將用戶上傳的螢幕截圖或手繪草圖作為參考,進行視覺創作,這對於需要快速原型設計或視覺輔助的專業人士來說,無疑是一大助力。
📅 3月10日:辦公協作工具深度整合
自今年3月10日起,Google Gemini擴展了與Google文件、試算表及簡報的深度整合,這直接導致了資料處理與呈現的流程更加流暢。這項整合應用使得用戶能直接在常用的辦公軟體中運用Gemini的AI能力,例如從Google雲端硬碟的資料直接建立儀表板,或是自動生成可編輯的簡報內容。相較於其他AI模型,Google Gemini在此方面的深度整合成為其獨特優勢,大幅提升了Google Workspace用戶的工作效率與協作流暢度。
📅 3月13日:地理資訊查詢更智慧化
緊接著在3月13日,Google發布了「Ask Maps」功能,讓用戶可以直接向Google Gemini查詢地圖相關資訊。舉例來說,用戶可以透過自然語言查詢「尋找附近附有照明設施的開放網球場」,Gemini便能快速提供符合條件的地理位置資訊。這項創新功能將地理資訊查詢從傳統的關鍵字搜尋提升至更智慧、更直觀的對話式互動,使得用戶在探索周遭環境或規劃行程時,能獲得更精準且個人化的建議。
📅 持續進化:個人化與自動化創新工具
為滿足個人化與自動化需求,Google Gemini推出了「Gems」功能,允許用戶根據特定指令建立客製化的Gemini版本,作為重複性任務的範本。這些客製化的Gem能自動生成替代文字(alt-text)、搜尋引擎優化(SEO)文本,甚至是發票或費用報告,極大簡化了日常的重複性工作。用戶甚至可以設定Gem來檢查內容是否存在偏見或盲點,進一步確保資訊的客觀性與準確性。此外,透過「Canvas」工具,Google Gemini能夠生成程式碼,用於建構網站、遊戲、工具、儀表板或互動式資訊圖表,並能依據用戶輸入的指標與設定的「思考模式」(Thinking mode),提供策略建議,展現其在開發與策略規劃上的潛力。
至今影響與未來展望
綜觀Google Gemini近期的一系列功能更新與整合應用,其在多功能性上表現出色,特別是在生成圖像、影片及歌曲,以及分析影片內容方面,展現了超越部分競爭對手的實力。根據報導指出,這些能力是如Claude等其他AI模型所無法達成的。此外,Google Gemini與Google旗下的NotebookLM整合程度優於ChatGPT,能同步查詢多個筆記本的內容,對於研究人員和內容創作者來說,這提供了更有效率的知識管理方案。儘管ChatGPT在自定義GPTs和與Canva、Figma等設計工具的內建應用程式方面擁有優勢,但Google Gemini在Google文件、試算表及簡報的深度整合,仍是其核心競爭力與獨特優勢,預期將持續鞏固其在企業與個人生產力工具市場的地位,引領AI整合應用的新趨勢。