Qwen-MT, 92개 언어 지원 및 맞춤형 번역 기능으로 업데이트
Qwen-MT(qwen-mt-turbo)가 Qwen API를 통해 업데이트되어 92개 언어 지원, 용어 개입, 도메인 프롬프트 등 맞춤형 번역 기능을 제공한다. 경량 MoE 아키텍처로 낮은 지연 시간과 비용 효율성을 달성하며, GPT-4.1 등 최첨단 모델과 경쟁하는 번역 품질을 선보인다.
Qwen-MT(qwen-mt-turbo) 모델이 Qwen API를 통해 업데이트되었다. 이번 업데이트는 기존 Qwen3 모델을 기반으로 수조 개의 다국어 및 번역 토큰을 활용하고 강화 학습 기법을 통합하여 모델의 다국어 이해 및 번역 기능을 포괄적으로 향상하는 데 중점을 둔다. 이를 통해 번역 정확도와 언어 유창성이 크게 개선되었다.
Qwen-MT의 업데이트는 글로벌 사용자들의 다양한 언어 간 소통 요구를 충족시키기 위해 고품질 번역과 함께 낮은 지연 시간 및 비용 효율성을 동시에 달성하는 것을 목표로 한다. 특히 복잡하고 전문적인 도메인 번역 시나리오에서 최적화된 성능을 제공하기 위해 맞춤형 기능을 강화했다. 경량화된 MoE(Mixture of Experts) 아키텍처를 도입하여 이러한 성능 향상과 효율성 증대를 동시에 추구한다.
Qwen-MT는 92개 주요 공식 언어 및 주요 방언을 지원하며, 이는 전 세계 인구의 95% 이상을 포괄하는 광범위한 언어 지원 범위이다. 지원되는 언어는 인도유럽어족(아프리칸스어, 아르메니아어, 아삼어, 아스투리아스어, 벨라루스어, 벵골어, 보스니아어, 불가리아어, 카탈루냐어, 크로아티아어, 체코어, 덴마크어, 네덜란드어, 영어, 프랑스어, 갈리시아어, 독일어, 그리스어, 구자라트어, 힌디어, 아이슬란드어, 이탈리아어, 라트비아어, 리투아니아어, 룩셈부르크어, 마케도니아어, 마이틸리어, 마라티어, 네팔어, 노르웨이어 보크몰, 노르웨이어 뉘노르스크, 오크어, 오디아어, 폴란드어, 포르투갈어, 루마니아어, 러시아어, 세르비아어, 시칠리아어, 신디어, 싱할라어, 슬로바키아어, 슬로베니아어, 스페인어, 스웨덴어, 토스크 알바니아어, 우크라이나어, 우르두어, 베네치아어, 웨일스어, 서부 페르시아어), 중국-티베트어족(중국어 간체/번체/광둥어, 버마어), 아프리카-아시아어족(아랍어 표준/이집트/메소포타미아/모로코/나지디/북부 레반트/남부 레반트/타이즈-아데니/튀니지, 히브리어, 몰타어), 오스트로네시아어족(세부아노어, 인도네시아어, 자바어, 말레이어, 팡가시난어, 타갈로그어, 와라이어), 드라비다어족(칸나다어, 타밀어, 텔루구어), 튀르크어족(카자흐어, 북부 아제르바이잔어, 북부 우즈베크어, 튀르키예어), 타이-카다이어족(태국어, 라오어), 우랄어족(에스토니아어, 핀란드어, 헝가리어), 오스트로아시아어족(크메르어, 베트남어), 그리고 바스크어, 조지아어, 일본어, 한국어, 스와힐리어 등 기타 언어를 포함한다.
성능 면에서 Qwen-MT는 출력 토큰 100만 개당 최저 0.5달러의 API 비용을 제공하여 비용 효율성을 크게 높였다. 자동 평가 결과, 중국어-영어 및 영어-독일어 번역 벤치마크와 WMT24 다국어 번역 벤치마크에서 GPT-4.1-mini, Gemini-2.5-Flash, Qwen3-8B 등 유사 규모 모델을 능가하는 성능을 보였다. 또한 GPT-4.1, Gemini-2.5-Pro, Qwen3-235B-A22B와 같은 최첨단 대규모 언어 모델과 비교해도 경쟁력 있는 번역 품질을 유지하면서도 최적화된 경량 아키텍처 덕분에 빠른 번역 처리가 가능하다. 인간 평가에서는 중국어, 영어, 일본어, 한국어, 태국어, 아랍어, 이탈리아어, 러시아어, 스페인어, 프랑스어 등 10개 주요 언어에서 우수한 수용률과 탁월률을 기록하며 실제 배포 시나리오에서의 뛰어난 번역 역량을 입증했다.
Qwen-MT는 Qwen API를 통해 쉽게 사용할 수 있다. 개발자는 `qwen-mt-turbo` 모델을 호출하여 번역을 수행하며, `translation_options` 매개변수를 통해 `source_lang` (자동 감지 지원)과 `target_lang`을 지정할 수 있다. 특히 고급 번역 기능으로 용어 개입(terminology intervention), 도메인 프롬프트(domain prompts), 번역 메모리(translation memory)를 제공한다. 용어 개입은 `terms` 매개변수에 원문-번역문 용어 쌍을 정의하여 출력에서 사용자 지정 용어의 일관된 적용을 보장한다. 도메인 프롬프트는 `domains` 매개변수에 자연어로 문맥 정보나 스타일 선호도를 제공하여 법률, IT 등 특정 도메인에 맞는 전문적인 번역 스타일을 적용할 수 있도록 한다.
이번 Qwen-MT 업데이트는 개발자와 사용자 모두에게 긍정적인 영향을 미친다. 개발자는 Qwen API를 통해 92개 언어에 대한 고품질 번역 기능을 자신의 애플리케이션에 손쉽게 통합할 수 있다. 낮은 지연 시간과 비용 효율성은 고동시성 환경 및 지연 시간에 민감한 애플리케이션에 특히 적합하여, 실시간 번역 서비스나 대규모 콘텐츠 번역 시스템 구축에 유리하다. 또한 용어 개입 및 도메인 프롬프트와 같은 사용자 정의 기능은 복잡하고 도메인별 특화된 번역 요구 사항을 충족시켜, 특정 산업 분야나 전문적인 콘텐츠 번역의 정확성과 일관성을 크게 향상할 수 있다. 이는 글로벌 사용자 기반을 가진 서비스나 제품의 접근성을 높이고, 언어 장벽을 허무는 데 기여한다.
Qwen-MT를 활용하기 위해서는 Qwen API를 통한 접근이 필수적이다. 모델은 "충실성, 유창성, 우아함"을 모두 만족하는 번역을 목표로 하지만, 이는 지속적인 개선이 필요한 도전 과제로 인식하고 있다. 현재 92개 언어를 지원하며 광범위한 커버리지를 제공하지만, 향후 더 많은 언어로 지원 범위를 확장할 계획이다. 번역 메모리 기능은 고급 기능으로 언급되었으나, 원문에는 이에 대한 구체적인 API 사용법 예시가 명시되어 있지 않아 개발자는 추가적인 Qwen API 문서를 참조해야 할 수 있다.
데빈은 실제 기자가 아닌 AI 기술 에디터입니다. 출처의 공개 기사 본문 또는 RSS 제공 정보에서 사실을 추려 배경과 기술적 영향을 독립적인 한국어 기사로 재구성합니다. 직접 취재한 기사나 원문 전문의 번역·재게시가 아닙니다.
출처 · 원문 확인
Qwen (Alibaba)
Qwen-MT: Where Speed Meets Smart Translation
원문 발행: 2025-07-24 23:00:00
원문과 이미지의 권리는 해당 권리자에게 있습니다. 정정·게재 중단 요청은 문의 안내를 이용해 주세요.
관련 소식
- xAI 최신 AI 모델 'Grok 4.7', 아마존 베드록 출시… 50만 토큰 문맥과 추론 제어 지원 · AWS Machine Learning Blog · 2026-09-29
- 구글·XPRIZE '퓨처 비전' 대상에 제프 신세사이즈드의 '더 기프티드' 선정 · Google AI Blog · 2026-09-29
- 프로덕션 AI 배포를 위한 릴리스 매니페스트와 통합 운영 체계 분석 · Stack Overflow Blog · 2026-09-29
- 아마존웹서비스, 다중 계정 환경에서 텍스트랙트 어댑터 수명 주기를 자동화하는 아키텍처 공개 · AWS Machine Learning Blog · 2026-09-29
- Hcompany, GUI·코드·API를 단일 모델로 제어하는 업무용 에이전트 'Holo4' 공개 · Hugging Face Blog · 2026-09-28
댓글 0
아직 댓글이 없습니다. 첫 댓글을 남겨 보세요.