NSMC (네이버 영화 코퍼스)
네이버 영화 리뷰 20만 건에 긍·부정을 붙인 한국어 감성분석 표준 데이터셋
e9t/nsmc
- 생성 · 마지막 push 네이버 영화 리뷰 20만 건에 긍·부정을 붙인 한국어 감성분석 표준 데이터셋
e9t/nsmc
- 생성 · 마지막 push “AI 기업들이 무료 한도를 째째하게 막는 게 킹받아서” — 상용 패키지 없이 파이토치 기본 연산만으로 Llama 3 규격(RMSNorm·SwiGLU·RoPE·KV-Cache)을 생코딩하고 노트북 GPU 24GB로 학습 중. 3,000스텝의 헛소리까지 공개
한국어 자연어처리 자료·도구·데이터셋을 모은 큐레이션 목록
트위터 한국어 분석기에서 이어진 오픈소스 한국어 텍스트 처리기
한국어 종단간(end-to-end) 음성인식 모델을 학습·평가하는 오픈소스 툴킷
카카오브레인이 공개한 한국어 생성 사전학습 모델
개인이 직접 학습시켜 공개한 한국어 ELECTRA 사전학습 모델
Dreamboat은 한국 인디 메이커들의 v0.1부터 시작한 changelog가 모이는 곳입니다.
NSMC(Naver sentiment movie corpus)는 네이버 영화 리뷰에 긍정·부정 라벨을 붙인 한국어 감성분석 데이터셋입니다.
NSMC(Naver sentiment movie corpus)는 네이버 영화 리뷰에 긍정·부정 라벨을 붙인 한국어 감성분석 데이터셋입니다. 한국 인디 메이커 생태계의 한국어NLP 사례로 Dreamboat 디스커버에 수록돼 있습니다.
NSMC (네이버 영화 코퍼스) — 한국어 감성분석을 처음 실습하는 학습자, 모델 파이프라인을 빠르게 검증하려는 개발자, 한국어 NLP 벤치마크 계보를 살펴보는 연구자, (실서비스 평가에는 최신 데이터가 필요합니다)에게 맞습니다.
NSMC (네이버 영화 코퍼스) 공식 사이트는 github.com/e9t/nsmc 이며, 여기서 바로 이용할 수 있습니다. Dreamboat 디스커버에서는 이 서비스가 무엇이고 누구에게 맞는지, 비슷한 한국 인디 메이커 서비스는 무엇이 있는지 함께 정리해 두었습니다.