[イーデイリーKim Hyun-ah 記者]LG Uplus(032640)が、AIモデルの最適化を専門とする企業「オプトAI」と提携し、AIサービスの運用効率を高める技術の開発に乗り出します。
AIサービスの増加に伴い、GPUや電力使用量も急速に増加しています。同じ性能を維持しつつ、より少ないリソースでAIを運用することが重要な課題となっています。
LGユープラスのイ・サンヨプCTO(左)と、オプトAIのイ・ジェホ代表が、トークン最適化技術に関する協力に際し、記念撮影を行っています。写真=LGユープラス
両社が注目している技術は「トークン最適化」です。
トークンとは、AIが質問を理解し、回答を作成する過程で処理するデータ単位のことです。トークン最適化とは、AIモデルを軽量化したり、演算方式を改善したりすることで、同じGPUでより多くのリクエストを処理できるようにする技術です。
LGユープラスは、実際のAIサービスを運用しながら技術を検証・適用します。オプトAIは、AIモデルをより小さく、より高速に動作させる技術の開発を担当します。
両社はこれを通じて、GPUと電力使用量を削減しつつ、AIの応答速度とサービス品質を向上させる計画です。
これに先立ち、両社はオンデバイスAIでも協力してきました。LG U+は、ExaOneベースの小型言語モデルに軽量化技術を適用し、スマートフォンのAI専用半導体であるNPU上で動作できるようにしました。
その結果、従来のCPU方式と同等の性能を維持しつつ、消費電力を78%、モデルサイズを82%削減しました。
今回は、協力の範囲をサーバーGPU環境へと拡大します。大規模なAIサービスを運用する際、同じGPUでより多くの利用者のリクエストを処理できるよう、AIモデルの演算プロセスを効率化する技術を共同で研究します。
現在、関連研究でも成果が出ています。両社は、AIが回答を生成するプロセスを実際のサービス環境に合わせて改善し、同じGPUで処理できるトークン量を従来より最大4倍に増やしました。
オプトAIは2021年11月に設立されたAI最適化スタートアップで、#LGエレクトロニクス出身のイ・ジェホ代表が率いています。AIモデルをNPU・GPU・CPUなどのハードウェアに合わせて軽量化・最適化する技術を保有しており、LGエレクトロニクス・LG U+などと協力しています。オンデバイスAI最適化プラットフォーム「オプトハンサー」を通じて、スマートフォン・自動車・ロボットなどへと事業を拡大しています。
両社は去る1日、「効率的なAI技術セミナー」も共同で開催しました。フューリオサAI、ベスルAI、韓国電子技術研究院(KETI)、漢陽大学などが参加し、AIモデルの最適化やAI半導体、実際のサービス適用事例などを共有しました。
LG U+は今後、確保した技術を自社のAIサービスや大規模なAIインフラに段階的に適用する計画です。
LGユープラスのイ・サンヨプCTOは、「AIの競争力は、単に性能を高めることにとどまらず、同じリソースでどれだけ多くのトークンを効率的に処理できるかにかかっている」とし、「様々なパートナーと協力し、トークン最適化技術の研究を拡大していく」と述べました。
オプトAIのイ・ジェホ代表は、「生成AIの時代においては、高い性能と同様に運用効率を確保することが重要だ」とし、「実際のサービス環境で検証可能なAI最適化技術を高度化していく」と述べました。
AIサービスの増加に伴い、GPUや電力使用量も急速に増加しています。同じ性能を維持しつつ、より少ないリソースでAIを運用することが重要な課題となっています。
両社が注目している技術は「トークン最適化」です。
トークンとは、AIが質問を理解し、回答を作成する過程で処理するデータ単位のことです。トークン最適化とは、AIモデルを軽量化したり、演算方式を改善したりすることで、同じGPUでより多くのリクエストを処理できるようにする技術です。
LGユープラスは、実際のAIサービスを運用しながら技術を検証・適用します。オプトAIは、AIモデルをより小さく、より高速に動作させる技術の開発を担当します。
両社はこれを通じて、GPUと電力使用量を削減しつつ、AIの応答速度とサービス品質を向上させる計画です。
これに先立ち、両社はオンデバイスAIでも協力してきました。LG U+は、ExaOneベースの小型言語モデルに軽量化技術を適用し、スマートフォンのAI専用半導体であるNPU上で動作できるようにしました。
その結果、従来のCPU方式と同等の性能を維持しつつ、消費電力を78%、モデルサイズを82%削減しました。
今回は、協力の範囲をサーバーGPU環境へと拡大します。大規模なAIサービスを運用する際、同じGPUでより多くの利用者のリクエストを処理できるよう、AIモデルの演算プロセスを効率化する技術を共同で研究します。
現在、関連研究でも成果が出ています。両社は、AIが回答を生成するプロセスを実際のサービス環境に合わせて改善し、同じGPUで処理できるトークン量を従来より最大4倍に増やしました。
オプトAIは2021年11月に設立されたAI最適化スタートアップで、#LGエレクトロニクス出身のイ・ジェホ代表が率いています。AIモデルをNPU・GPU・CPUなどのハードウェアに合わせて軽量化・最適化する技術を保有しており、LGエレクトロニクス・LG U+などと協力しています。オンデバイスAI最適化プラットフォーム「オプトハンサー」を通じて、スマートフォン・自動車・ロボットなどへと事業を拡大しています。
両社は去る1日、「効率的なAI技術セミナー」も共同で開催しました。フューリオサAI、ベスルAI、韓国電子技術研究院(KETI)、漢陽大学などが参加し、AIモデルの最適化やAI半導体、実際のサービス適用事例などを共有しました。
LG U+は今後、確保した技術を自社のAIサービスや大規模なAIインフラに段階的に適用する計画です。
LGユープラスのイ・サンヨプCTOは、「AIの競争力は、単に性能を高めることにとどまらず、同じリソースでどれだけ多くのトークンを効率的に処理できるかにかかっている」とし、「様々なパートナーと協力し、トークン最適化技術の研究を拡大していく」と述べました。
オプトAIのイ・ジェホ代表は、「生成AIの時代においては、高い性能と同様に運用効率を確保することが重要だ」とし、「実際のサービス環境で検証可能なAI最適化技術を高度化していく」と述べました。