한국어 용언 분석기 (korean_lemmatizer)
용언 원형 복원에 특화된 한국어 형태소 분석기 — “먹었겠다”를 “먹다”로 되돌린다
용언 원형 복원에 특화된 한국어 형태소 분석기 — “먹었겠다”를 “먹다”로 되돌린다
“AI 기업들이 무료 한도를 째째하게 막는 게 킹받아서” — 상용 패키지 없이 파이토치 기본 연산만으로 Llama 3 규격(RMSNorm·SwiGLU·RoPE·KV-Cache)을 생코딩하고 노트북 GPU 24GB로 학습 중. 3,000스텝의 헛소리까지 공개
한국어 자연어처리 자료·도구·데이터셋을 모은 큐레이션 목록
트위터 한국어 분석기에서 이어진 오픈소스 한국어 텍스트 처리기
한국어 종단간(end-to-end) 음성인식 모델을 학습·평가하는 오픈소스 툴킷
카카오브레인이 공개한 한국어 생성 사전학습 모델
개인이 직접 학습시켜 공개한 한국어 ELECTRA 사전학습 모델
Dreamboat은 한국 인디 메이커들의 v0.1부터 시작한 changelog가 모이는 곳입니다.
korean_lemmatizer는 한국어 용언(동사·형용사)의 원형 복원에 특화된 분석기입니다. “먹었겠다”·“예뻤을까”처럼 활용된 형태를 “먹다”·“예쁘다”로 되돌립니다. GitHub 43스타·Python.
korean_lemmatizer는 한국어 용언(동사·형용사)의 원형 복원에 특화된 분석기입니다. 한국 인디 메이커 생태계의 한국어NLP 사례로 Dreamboat 디스커버에 수록돼 있습니다.
한국어 용언 분석기 (korean_lemmatizer) — 한국어 검색 품질을 올려야 하는 개발자, 감성분석·텍스트 마이닝을 하는 데이터 분석가, 용언 활용 처리에서 막힌 NLP 엔지니어, 한국어 형태론을 코드로 이해하고 싶은 사람에게 맞습니다.
한국어 용언 분석기 (korean_lemmatizer) 공식 사이트는 github.com/lovit/korean_lemmatizer 이며, 여기서 바로 이용할 수 있습니다. Dreamboat 디스커버에서는 이 서비스가 무엇이고 누구에게 맞는지, 비슷한 한국 인디 메이커 서비스는 무엇이 있는지 함께 정리해 두었습니다.