Open Korean Text
트위터 한국어 분석기에서 이어진 오픈소스 한국어 텍스트 처리기
open-korean-text/open-korean-text트위터 한국어 분석기에서 이어진 오픈소스 한국어 텍스트 처리기
open-korean-text/open-korean-text“AI 기업들이 무료 한도를 째째하게 막는 게 킹받아서” — 상용 패키지 없이 파이토치 기본 연산만으로 Llama 3 규격(RMSNorm·SwiGLU·RoPE·KV-Cache)을 생코딩하고 노트북 GPU 24GB로 학습 중. 3,000스텝의 헛소리까지 공개
한국어 자연어처리 자료·도구·데이터셋을 모은 큐레이션 목록
한국어 종단간(end-to-end) 음성인식 모델을 학습·평가하는 오픈소스 툴킷
카카오브레인이 공개한 한국어 생성 사전학습 모델
개인이 직접 학습시켜 공개한 한국어 ELECTRA 사전학습 모델
SKT가 공개한 한국어 BERT — 한국어 NLP의 오랜 기준선이었던 모델
Dreamboat은 한국 인디 메이커들의 v0.1부터 시작한 changelog가 모이는 곳입니다.
Open Korean Text는 오픈소스 한국어 텍스트 처리기입니다. 트위터가 만들었던 한국어 분석기(twitter-korean-text)를 커뮤니티가 이어받은 프로젝트입니다.
Open Korean Text는 오픈소스 한국어 텍스트 처리기입니다. 한국 인디 메이커 생태계의 한국어NLP 사례로 Dreamboat 디스커버에 수록돼 있습니다.
Open Korean Text — SNS·댓글 텍스트를 분석하는 개발자, 학습 없이 바로 쓸 형태소 분석기가 필요한 사람, 자바·스칼라 환경에서 한국어를 다루는 개발자, 한국어 분석기 계보를 살펴보는 연구자에게 맞습니다.
Open Korean Text 공식 사이트는 github.com/open-korean-text/open-korean-text 이며, 여기서 바로 이용할 수 있습니다. Dreamboat 디스커버에서는 이 서비스가 무엇이고 누구에게 맞는지, 비슷한 한국 인디 메이커 서비스는 무엇이 있는지 함께 정리해 두었습니다.