TechFeedTechFeed
AI/LLM

네이버 태국어 LLM, 시암AI, 오픈소스 | 동남아 모델은 어디에 붙이나?

네이버클라우드가 태국 시암AI와 태국어 소버린 AI 모델·관광 에이전트를 유상계약으로 지난해 말 완료했다는 보도를 정리한다. 오픈소스 공개, 필리핀·인도네시아 양해각서 중단, 세종 AI 팩토리 200MW, 라이선스·평가셋·데이터 상주 체크리스트. LLM, API, 클라우드, 오픈소스, 개발자가 붙이기 전 칸 나누기 가이드.

by

네이버클라우드는 태국 시암AI와 진행한 태국어 소버린 AI 모델과 관광 특화 에이전트 프로젝트를 유상계약으로 지난해 말 마쳤다고 보도됐습니다. 모델은 오픈소스로 공개됐고, 필리핀·인도네시아 쪽 협력은 양해각서 이후 멈춘 상태입니다. 2025년 5월 발표 뒤 실제 매출로 이어진 동남아 건은 태국뿐입니다.


동남아 로케일 앱에 모델을 붙일 팀은 계약 형태, 라이선스, 평가셋, 데이터 위치를 먼저 칸으로 나눕니다. 대형 양해각서가 매출로 이어진 사례와 아닌 사례가 같은 보도에 같이 있습니다. 저장소 주소가 확인되기 전에는 가중치를 받지 않습니다.


지난해 말 끝난 것 | 태국어 모델과 유상계약

보도 기준 끝난 일은 시암AI와의 유상 프로젝트입니다. 2025년 5월 발표한 태국어 특화 모델과 관광 특화 에이전트 협력이, 양해각서에서 그치지 않고 계약과 완료 시점까지 갔습니다. 개발된 태국어 특화 모델은 오픈소스로 공개됐다고 전했습니다.


협력시점보도된 상태
태국 시암AI, 태국어 모델·관광 에이전트2025년 5월 발표, 지난해 말 완료유상계약 완료, 모델 오픈소스 공개
필리핀 컨버지ICT2024년 5월 양해각서진행 중인 협업 없음(회사 설명)
인도네시아 텔콤·시스코2023년 3월 협력진행 중인 협업 없음(회사 설명)
사우디 디지털트윈3개 도시 1단계 완료, 2026년 5월 2단계 본계약해외 AI의 중심 레퍼런스로 유지
아랍어 모델(리벨리온 양해각서)2025년 2월추가 진척 보도 없음
모로코 AI 데이터센터 1단계 40MW2025년 안 구축 안내였음진행 사항 공개 없음

원문은 머니투데이 2026년 8월 12일 단독입니다. 2025년 5월 발표문은 네이버클라우드 보도자료에 남아 있습니다.


양해각서와 유상계약은 다른 칸 | 동남아 공개 사례 세 건 중 태국만 유상 완료로 보도됐습니다. 파트너 슬라이드에 로고를 나열할 때, 완료·진행·중단을 색깔로 나눕니다.


네이버클라우드와 동남아 언어 모델 협력을 나타낸 지도형 다이어그램
태국은 유상 완료, 필리핀·인도네시아는 양해각서 이후 멈춘 상태로 보도됐다

소버린 AI라고 부를 때 팀이 확인할 네 칸

네이버클라우드는 소버린 AI를 데이터 위치만이 아니라, 각국이 자국 언어·문화·제도에 맞게 모델을 만들고 운영·통제할 수 있는 역량이라고 설명합니다. 팀에 번역하면 네 칸입니다. 언어 성능, 데이터 상주, 운영 주체, 라이선스입니다.


태국어 특화 모델이 오픈소스로 공개됐다는 문장만으로는 상업 이용, 재학습, 출력 필터, 가중치 재배포가 허용되는지 알 수 없습니다. 저장소의 라이선스 파일과 허용 국가, 금지 용도를 먼저 읽습니다. 모델 카드에 평가 언어가 태국어만 있으면, 영어 섞인 관광 채팅은 따로 테스트해야 합니다.


관광 에이전트는 모델과 별 상품입니다. 항공·호텔 API, 결제, 개인정보 보관 위치가 모델 가중치보다 먼저 막힙니다. 현지 개인정보 법을 계약서 부록에 붙이지 않은 채 “소버린” 한 줄만 쓰면, 검수에서 다시 열립니다.


범용 모델 대신 태국어 특화를 붙이는 조건

기본값은 여전히 범용 대형 모델입니다. 태국어 특화를 검토하는 조건은 좁습니다. 태국어 비율이 높은 고객 응대, 현지 고유명사·행정 용어, 데이터를 국외로 못 보내는 계약, 발주처가 자국 모델을 명시한 입찰입니다.


상황먼저 쓸 쪽특화 모델을 여는 조건
태국어 10% 미만 사내 도구기존 범용 API품질 이슈가 태국어에 집중될 때
방콕 관광 챗봇특화 + 범용 폴백지명·메뉴·교통 고유명사 오류가 클 때
공공·금융 입찰발주 조건서자국 모델·반출 금지가 명시된 경우
다국어 동일 품질범용 + 언어별 평가셋태국어만 기준 미달일 때 교체

폴백을 반드시 둡니다. 특화 모델이 영어 코드나 JSON 스키마에서 무너지는 경우가 많습니다. 라우터에서 언어 감지 후 태국어만 특화로 보내고, 도구 호출은 범용으로 남기는 구성이 흔합니다. 오픈 모델 대비는 네모트론4 공개 전 체크와 같이 라이선스·서빙 비용을 같은 표에 둡니다.


태국어 특화 모델과 범용 API를 나누는 라우팅 화이트보드
태국어 대화만 특화로 보내고, 도구 호출과 영어 코드는 범용 폴백을 둔다

오픈소스 공개 문장을 코드로 옮기기 전에

보도는 모델명을 특정하지 않았습니다. 저장소를 찾기 전에 공식 배포 채널(네이버클라우드, 시암AI, 허깅페이스 조직)만 믿습니다. 이름만 비슷한 가중치를 받아 프로덕션에 올리면 공급망 사고가 납니다.


받은 뒤에는 네 파일을 같은 커밋에 남깁니다. 라이선스, 모델 카드, 학습 데이터 고지, 허용 사용 범위입니다. 상업 서비스에 쓰려면 출력 면책과 로깅 보관 기간도 법무 한 줄을 받습니다. 벤치마크 숫자를 기사에서 재인용하지 마세요. 기사에 점수가 없습니다.


평가셋은 번역기가 만든 문장이 아니라, 실제 상담·관광 로그에서 개인정보를 지운 200~500턴이면 충분합니다. 경어, 방언, 영어 섞인 문장, 숫자·주소가 들어간 문장을 비율로 넣습니다. 점수가 범용 모델과 비슷하면 특화를 붙일 이유가 없습니다.


세종 AI 팩토리와 어떻게 이어 읽나

같은 보도는 다음 변수로 세종 AI 팩토리를 꼽습니다. 네이버는 2분기 실적에서 세종 데이터센터를 거점으로 1단계 200MW 규모를 만들고, 아시아태평양·중동 소버린 수요를 받겠다고 했습니다. 태국 건은 “언어 모델을 만들어 본 레퍼런스”, 세종은 “그 모델을 돌릴 전력·GPU 공장”으로 읽으면 역할이 겹치지 않습니다.


계약 구조(운영 자회사, GPU 소유, 사용료)는 네이버 AI 팩토리 딜 읽기에 따로 있습니다. 엔비디아·브룩필드 투자 규모는 14조 투자 보도를 옆에 둡니다. 클로드 쪽 간접 투자 소식은 네이버·앤트로픽과 섞지 마세요. 언어 모델 수출과 펀드 투자는 의사결정 단위가 다릅니다.


국내 통신사 한국어 모델과 비교할 때는 언어와 고객이 다릅니다. SKT 독파모는 국내 업무용 한국어, 이번 건은 태국어 현지화입니다. 같은 “소버린” 단어를 써도 평가셋과 SLA가 다릅니다.


세종 데이터센터와 해외 소버린 AI 수요를 연결한 인프라 개념도
태국 모델은 레퍼런스, 세종 팩토리는 전력·GPU 공급. 한 슬라이드에 섞지 않는다

참고 자료


모델 카드와 라이선스는 공식 저장소가 확인된 뒤에만 시트에 붙입니다. 기사에 없는 파라미터 수·벤치 점수는 적지 않습니다.


자주 묻는 질문

태국어 모델은 언제 완료됐나요?

머니투데이 보도는 네이버클라우드가 시암AI와 유상계약으로 진행한 프로젝트를 지난해 말 완료했다고 전합니다. 공식 모델명과 저장소 주소는 해당 기사에 없습니다.


오픈소스로 공개됐다면 상업 서비스에 바로 써도 되나요?

공개와 상업 허용은 다릅니다. 저장소 라이선스, 재학습·재배포, 사용 금지 분야를 확인하기 전에는 프로덕션에 올리지 않습니다. 기사만으로는 라이선스 종류를 특정할 수 없습니다.


필리핀·인도네시아 협력은 무산인가요?

네이버클라우드는 양해각서 이후 사업 방향과 우선순위가 바뀌어 현재 특별히 진행 중인 협업이 없다고 밝혔습니다. 재개 여부는 공개되지 않았습니다.


사우디 디지털트윈은 이번 태국어 모델과 같은 사업인가요?

아닙니다. 사우디 건은 도시 디지털트윈 플랫폼이고, 태국 건은 언어 모델과 관광 에이전트입니다. 해외 AI 레퍼런스라는 점만 같고, 기술 스택과 계약이 다릅니다.


범용 챗지피티·클로드 대신 바꿔야 하나요?

태국어 비중이 낮으면 바꿀 이유가 작습니다. 현지 고유명사 오류, 데이터 반출 금지, 발주처의 자국 모델 요구가 있을 때 특화를 평가셋으로 비교한 뒤 결정합니다.


세종 AI 팩토리가 생기면 이 모델을 거기서 돌리나요?

보도는 세종 1단계 200MW로 아시아태평양·중동 수요를 받겠다는 구상을 전합니다. 태국어 가중치를 어디에 호스팅할지는 공개되지 않았습니다. 입찰 문서는 호스팅 지역을 따로 적습니다.


네이버태국어 LLM시암AI소버린 AI오픈소스네이버클라우드LLMAPI클라우드개발자데이터

관련 도구

함께 보면 좋은 문제 해결

EXPLORE / AI/LLM

이어서 읽어보기

전체 토픽 둘러보기