ニュース

オープンソース公開完了、KRAFTONのAIモデルブランド「RAON」発足
오픈 소스 공개 완료, 크래프톤 AI 모델 브랜드 '라온' 출범

AIの概要
クラフトンがAIブランド「ラオン」を立ち上げ、4種の基盤モデルをHugging Faceに公開しました。 音声言語モデルやリアルタイム対話モデルなど、多様なAI技術のグローバル競争力を立証しました。 今後もAIモデルとエージェント技術を高高度化し、技術革新をリードしていく計画です。
クラフトンのAIモデルブランド「ラオン」のロゴ
▲ クラフトンのAIモデルブランド「ラオン」のロゴ(画像提供:クラフトン)

クラフトンが自社開発した人工知能(AI)モデルブランド「ラオン(Raon)」を公式立ち上げし、4種の基盤モデルをグローバルプラットフォームのHugging Faceにオープンソースとして公開した。公開されたモデルは、音声対応の大規模言語モデル(LLM)、リアルタイム音声対話モデル、テキスト読み上げ(TTS)モデル、そしてビジョンエンコーダーである。今回の公開は、クラフトンがデータ収集からモデル学習、性能評価までの全プロセスを自社で行えるAI技術力を証明した結果である。

核心モデルの一つである「ラオン・スピーチ(Raon-Speech)」は、90億(9B)パラメータ規模の音声言語モデルであり、音声の理解と生成が可能である。同モデルは10B以下級の公開音声言語モデルのうち、英語と韓国語の双方でグローバル1位の性能を記録した。音声テキスト変換、テキスト音声変換、音声ベースの質疑応答など7つの核心タスクと40のベンチマークを総合評価した結果である。

また、「ラオン・スピーチチャット(Raon-SpeechChat)」は、ユーザーとモデル間の自由な双方向通信(Full-duplex)技術を適用したリアルタイム音声言語モデルであり、韓国国内で初めて発表されたモデルである。同モデルは、双方向通信評価ベンチマークにおいて、相槌、割り込み処理、応答遅延時間など13のタスク平均順位を基準にグローバル最上位圏の性能を示した。

「ラオン・オープンTTS(Raon-OpenTTS)」は、公開された音声データのみで学習されたテキスト読み上げモデルである。従来は活用が難しかったデータを直接収集・精製して公開し、全体の学習データも併せて提供する。同モデルは、人間のブラインド評価において、非公開データ基盤のグローバル研究用TTSモデルと比較し、最上位水準の性能を証明した。

「ラオン・ビジョンエンコーダー(Raon-VisionEncoder)」は、画像をAIが理解可能な情報に変換するビジョンエンコーダーである。同モデルは事前学習されたモデルを使用せず、公開データのみを活用してゼロから自社学習された。一部の視覚認識タスクでは、グーグルのビジョンエンコーダーモデル(SigLIP2)を上回る結果を記録し、他のタスクでもSigLIP2比で90%以上の性能を示して競争力を備えている。この技術は今後、「独自AI基盤モデル」プロジェクトに活用される。

クラフトンのイ・ガンウク最高人工知能責任者(CAIO)は、「今回のラオンモデルシリーズの公開は、AI技術力を蓄積していく過程の重要なマイルストーンである」と述べた。さらに、「大規模な学習データと核心モデルをオープンソースとして共有し、研究者や開発者が自由に活用することで、マルチモーダル技術の発展と韓国国内のAIエコシステムの成長に寄与することを期待している」と付け加えた。クラフトンはラオンを中心に、グローバルAI技術の競争力を継続的に強化していく方針である。

クラフトンは昨年、パーソナルAIアシスタントの「キラ(KIRA)」を披露しており、先月にはAIエージェントの性能を改善する「ターミナス・キラ(Terminus-KIRA)」技術をオープンソースとして公開し、技術競争力を強化した。また、コープレイブルキャラクターのようなAI基盤のインタラクティブコンテンツを通じて新たなゲーム体験を拡張しており、今後もAIモデルとエージェント技術の高高度化を続け、技術革新をリードしていく方針である。

クラフトンのAIモデルブランド「ラオン」のイメージ
▲ クラフトンのAIモデルブランド「ラオン」のイメージ(画像提供:クラフトン)
크래프톤 AI 모델 브랜드 라온 로고(사진제공: 크래프톤)
▲ 크래프톤 AI 모델 브랜드 라온 로고(사진제공: 크래프톤)

크래프톤이 자체 개발한 인공지능(AI) 모델 브랜드 ‘라온(Raon)’을 공식 출범하고, 4종의 파운데이션 모델을 글로벌 플랫폼 허깅페이스(Hugging Face)에 오픈소스로 공개했다. 공개된 모델은 음성 지원 대규모 언어 모델(LLM), 실시간 음성 대화 모델, 텍스트-음성 변환(TTS) 모델, 그리고 비전 인코더다. 이번 공개는 크래프톤이 데이터 수집부터 모델 학습, 성능 평가까지 전 과정을 자체 수행할 수 있는 AI 기술 역량을 입증한 결과다.

핵심 모델 중 ‘라온 스피치(Raon-Speech)’는 90억(9B) 파라미터 규모의 음성 언어 모델로, 음성 이해와 생성이 가능하다. 이 모델은 10B 이하급 공개 음성 언어 모델 중 영어와 한국어 모두에서 글로벌 1위 성능을 기록했다. 음성 텍스트 변환, 텍스트 음성 변환, 음성 기반 질의응답 등 7개 핵심 태스크 및 40개 벤치마크를 종합 평가한 결과이다. 

또한 ‘라온 스피치챗(Raon-SpeechChat)’은 사용자와 모델 간 자유로운 양방향 통신(Full-duplex) 기술을 적용한 실시간 음성 언어 모델이며, 국내 최초로 발표된 모델이다. 이 모델은 양방향 통신 평가 벤치마크에서 맞장구, 끼어들기 처리, 응답 지연 시간 등 13개 태스크 평균 순위 기준 글로벌 최상위권 성능을 보였다.

‘라온 오픈TTS(Raon-OpenTTS)’는 공개된 음성 데이터만으로 학습된 텍스트-음성 변환 모델이다. 기존에 활용이 어려웠던 데이터를 직접 수집 및 정제하여 공개했으며, 전체 학습 데이터도 함께 제공한다. 이 모델은 사람의 블라인드 평가에서 비공개 데이터 기반의 글로벌 연구용 TTS 모델들과 비교해 최상위 수준의 성능을 입증했다. 

‘라온 비전 인코더(Raon-VisionEncoder)’는 이미지를 AI가 이해 가능한 정보로 변환하는 비전 인코더다. 이 모델은 사전 학습된 모델을 사용하지 않고 오직 공개 데이터만을 활용하여 처음부터 자체 학습됐다. 일부 시각 인식 태스크에서는 구글의 비전 인코더 모델(SigLIP2)을 상회하는 결과를 기록했으며, 다른 태스크에서도 SigLIP2 대비 90% 이상의 성능을 보여 경쟁력을 갖춘다. 이 기술은 향후 ‘독자 AI 파운데이션 모델’ 프로젝트에 활용된다.

이강욱 크래프톤 최고인공지능책임자(CAIO)는 “이번 라온 모델 시리즈 공개는 AI 기술 역량을 축적하는 과정의 중요한 이정표다”라고 말했다. 그는 “대규모 학습 데이터와 핵심 모델을 오픈소스로 공유해 연구자와 개발자들이 자유롭게 활용하고, 멀티모달 기술 발전과 국내 AI 생태계 성장에 기여하기를 기대한다”고 덧붙였다. 크래프톤은 라온을 중심으로 글로벌 AI 기술 경쟁력을 지속적으로 강화한다.

크래프톤은 지난해 개인용 AI 비서 키라(KIRA)를 선보였으며, 지난달에는 AI 에이전트 성능을 개선하는 ‘터미너스-키라(Terminus-KIRA)’ 기술을 오픈소스로 공개하며 기술 경쟁력을 강화했다. 또한 코플레이어블 캐릭터와 같은 AI 기반 상호작용 콘텐츠를 통해 새로운 게임 경험을 확장하며, 앞으로도 AI 모델과 에이전트 기술의 고도화를 이어가 기술 혁신을 선도한다는 방침이다.

크래프톤 AI 모델 브랜드 라온 로고(사진제공: 크래프톤)
▲ 크래프톤 AI 모델 브랜드 '라온' 이미지 (사진제공: 크래프톤)
このニュースはAIによって翻訳されました。