아하 커뮤니티, 고품질 한국어 코퍼스 데이터 시장 공급 본격화
상태바
아하 커뮤니티, 고품질 한국어 코퍼스 데이터 시장 공급 본격화
  • 박선기
  • 승인 2024.01.17 09:53
  • 댓글 0
이 기사를 공유합니다

아하 커뮤니티가 고품질 한국어 데이터 판매를 본격화했다
아하 커뮤니티가 고품질 한국어 데이터 판매를 본격화했다

소셜 Q&A 커뮤니티 ‘아하’를 운영 중인 아하앤컴퍼니 주식회사(대표 서한울)가 자사 서비스 내 축적된 고품질 한국어 데이터 판매를 본격적으로 시작했다고 16일 밝혔다. LLM을 자체 개발하거나 AI 및 데이터 관련 사업을 위해 고품질 한국어 데이터가 필요한 기업 등을 주요 잠재 고객으로 타기팅한다.

법률, 세금/세무, 인사/노무, 의료, 약료, 반려동물, 치과, 보험, 부동산 등 다양한 분야의 질문 및 전문가 답변 데이터가 주요 판매 상품이며, 1차적인 데이터 가공(개인정보 제거 등)이 선행돼 고객사의 검수 편의성 확보 및 학습 시 부적합한 답변 가능성을 줄여준다.

또한 아하 커뮤니티의 한국어 데이터는 질문 내용에 대한 답변만을 포함하고 있으며, 통상적인 짧은 문답이 아닌 특정 상황에 대한 자세한 답변으로 구성돼 있어 일반적인 한국어 데이터셋과 차별화된 강점을 보인다.

특히 아하 커뮤니티는 활동하는 전문가를 대상으로 내부 정책에 따른 아하 지수 및 어뷰징 적발 알고리즘을 통해 답변자의 답변 퀄리티를 유지 중이며, 하기 기준들을 통한 답변자 내부 랭킹 산정 등 콘텐츠 QC 정책을 통해 고품질 한국어 데이터 생산 환경을 구축하고 있다.

서한울 아하 커뮤니티 대표는 “2024년 2월 진행 예정인 웹/앱 대규모 리뉴얼 작업 이후 더 다양한 분야의 고품질 한국어 데이터 생산 환경이 구축될 것”이라며 “향후 고품질 한국어 데이터 생산을 기반으로 한 데이터 공급 비즈니스 확대를 통해 큰 규모의 매출 성장을 기대한다”고 말했다.
 


댓글삭제
삭제한 댓글은 다시 복구할 수 없습니다.
그래도 삭제하시겠습니까?
댓글 0
댓글쓰기
계정을 선택하시면 로그인·계정인증을 통해
댓글을 남기실 수 있습니다.
주요기사
이슈포토