生成式AI的商業機會與挑戰:
意藍資訊在 AI 技術上的應用
生成式AI是一種人工智慧技術,主要特點是能夠生成新的內容,例如文字、圖像或音訊,來解決問題。而意藍資訊除了有自行研發的大語言模型eLAND GOAT外,也推出了許多的AI智能數據解決方案。
本期 AI 知識庫亮點
認識生成式AI
生成式AI的應用場域與未來發展
意藍資訊的AI服務應用
認識生成式AI
生成式AI的原理是什麼?
生成式AI是 基於深度學習,透過擁有大參數量的神經網絡來記憶學習大量的資料,並且在沒有明確標籤或指導之下,自行學習資料的分佈,來生成更多類似的資料。工作邏輯就好比文字接龍遊戲,使用者在輸入詞句後,生成式AI便會根據過往學習時曾看過的訓練資料,來評估該詞句接下來在高機率的情況下會產生的字詞為何,並進行相對應的文字生成。
目前的生成式AI通常會配合兩種建立模型的技術,第一個是預訓練 (pre-train),也就是先在沒有特定任務目標的情況下先進行模型的訓練,之後再將該訓練好的模型投入到實際應用中。打一個比方,就像預先訓練AI的基本語文能力,之後在克漏字測驗、改錯、造句、摘要、閱讀理解等任務上都會用到這些能力;另一個是大模型 (large model),包括不斷推升神經網路模型的參數量規模,以及給予更多的訓練資料,都是希望讓生成式AI的能力及適用狀況可以更加地擴大。
生成式AI的應用場域與未來發展
生成式AI的應用實例
生成式AI可以在文書生成、摘要、提供方法推論、回答知識題等方面提供協助,並且也能在行銷、廣告、政治社會等領域,甚至是學術研究、政府單位當中扮演探索或發想性質的角色。不過需要注意的是,若是要針對如計算題這種有標準答案的內容時,生成式AI有時可能無法完全正確的回應,這時就會需要仰賴使用者再多留意與求證。
生成式AI的挑戰與未來趨勢
2023年劍橋字典選出的年度代表字:Hallucination (幻想),其便反應了人工智慧的可信賴性會是一大挑戰,尤其生成式AI有杜撰、編造消息來源的不可控性。因為生成式AI的能力一大部分是仰賴過往曾經看過的訓練資料再經過類似機率選擇的過程來生成內容,因此存在不確定性,以及拼湊內容、無中生有的可能。另外,生成式AI還有資安風險的隱憂,例如提供的資訊被模型業者拿去做為訓練模型之用,而近來也有許多例子都能證實,即使在訓練模型時設了重重關卡,訓練出來的模型還是可能會在無意之間把公司內的機敏資料洩漏出去。
而要克服這些問題,首先我們要能讓AI產出的答案變成是載明參考資料出處且可驗證的。在未來,生成式AI模型一定會不斷推陳出新,成為繼30年前圖形化界面 (Graphical User Interface) 之後,最大的一個人機界面革命,可以理解使用者的口語表達並完成各項任務的自然介面 (Natural User Interface)。目前已有利用生成式AI的自動化框架,能夠將一個任務的所有工作流程進行拆解的案例,使得生成式AI可以去完成每一個環節相應的步驟,成為生成式AI發展的趨勢方向。
意藍資訊的AI服務應用
意藍大語言模型eLAND GOAT 與 OpenAI的差異
而為了解決生成式AI在應用上的幻想杜撰、資安等問題,以及台灣本土大語言模型缺乏繁體 (正體) 中文語料等情況,意藍資訊也在AI領域持續追求成長與卓越。相較於OpenAI的GPT模型,由意藍所自行研發出的大語言模型eLAND GOAT,即是以大量台灣社群網站、網路媒體的繁體中文語料進行訓練,具備了更好的繁體中文理解、生成能力,在使用上能夠提供更為在地化的體驗。此外,相較於OpenAI僅提供放在公有雲上的模型,eLAND GOAT能夠提供企業小型化、特式化 (specialized) 的地端模型,可以運行在企業內部環境中,依循企業組織的權限設定,滿足企業對於資安上的需求。
意藍AI智能數據解決方案
除了大語言模型eLAND GOAT,意藍資訊也致力於發展各式AI智能數據解決方案,來滿足客戶在不同場域的各種需求,如:
輿情GPT
結合全台最大的社群口碑資料庫OpView,讓使用者能夠在輸入簡單的關鍵詞後,快速找出最相關的資料,並藉由生成式AI來生成口語化、條列重點的輿情精華摘要,解決過去在解讀社群輿情時,需要人工對話題逐篇檢視、理解的時間。
AI Search for EC 新一代智能貼標與搜尋推薦系統
以AI語意分析技術,自動解析商品中所帶有的各式資訊文本,生成能代表商品的重點標籤,再綜合評估聲量、搜量、銷量等多元指標,能有效解決電商品牌在商品曝光、推薦、搜尋引擎優化上的各項痛點,讓消費者可以更精準的找所需的商品。
AI Search for KM 新一代生成式AI知識管理系統
整合了生成式AI、搜尋引擎,和NLP(自然語言處理)技術,讓企業員工只要上傳知識文件後,就可以輕鬆地檢索和提問,且AI Search for KM專注於企業自身所建構的知識庫,確保回答乃基於實際數據和企業內部知識,並提供地端運算方案,避免內部資料外洩風險。