로고 이미지

고정 헤더 영역

글 제목

메뉴 레이어

로고 이미지

메뉴 리스트

  • 홈
  • 태그
  • 방명록
  • 분류 전체보기 (31)
    • Story (2)
    • Data Scientist (26)

검색 레이어

로고 이미지

검색 영역

컨텐츠 검색

NLP 딥논읽 청강의 청강 11월 10, 11, 12일 주제

11월 4번째 주제는 BART 논문입니다. 다름이 아니라 제가 대회를 하고 있는데 적용하게 된 모델이 KoBART라서 리뷰하게 되었습니다. 기회되면 KoBART도 따로 다루겠습니다. https://arxiv.org/abs/1910.13461 BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension We present BART, a denoising autoencoder for pretraining sequence-to-sequence models. BART is trained by (1) corrupting text with an arbitrary noisin..

신입의 경력 기술서 쓰기 팁.

아직 취직도 안 했기 때문에 팁이라고 쓰기엔 좀 뭐하지만, 개발자로 취직을 준비하면서 만들어두면 좋은 것에 대해 써보려고 만들어봤다. 나는 이걸 만들어본 지 1년 정도 되었고, 주위에서 피드백을 받아서 완성해둔 상태이다. 프로젝트를 더 쌓아갈 때마다 수정했다. ​ 경력기술서에 대한 팁은 이미 검색해 보면 많이 나와있기 때문에 작성을 조금 고민했지만, 그냥 써보기로 했다. ​ 참고로 정말 간단하다. ​ 일단, Word 문서에서 새로 만들기를 클릭하면 여러 양식이 나온다. 나는 여기서 이력서 및 자기소개서를 검색해서 이 양식으로 하나 만들었다. ​ 대신 가로를 길게 만들어서 공간을 크게 썼다. 왼쪽 공백을 사진 한두개 넣을 수 있을 만큼 크게 뒀다. ​ 첫장에는 내 기본 정보와 사이트를 두었다. 사이트는 Q..

레노버 요가북( Lenovo C740-14IML ) 언박싱 + 리뷰!

연계전공에 진입하면서 LG gram 노트북을 받았었는데 이제 졸업하게 되면서 그 깡통이 된 노트북을 반납하게 되었다. 험하게 쓴 터라 많이 망가진 그 노트북보다 좋은 노트북을 찾으려고 몇달을 헤매면서 좋은 그래픽카드가 들어간 것을 찾다가, 현업에 종사하는 사람의 조언을 듣고 cpu가 좋은 노트북을 찾기로 하였다. 그러다가 찾은 게 이 레노버 요가북! 보다시피 요즘 삼성에서 광고하는 삼성 갤럭시 플렉스처럼 완전히 반대로 꺾여 접히는 모델이다. 여러가지 방향으로 가능하다고 광고하는데, 대표적으로 저렇게 태블릿 모드(실제 태블릿 모드가 실행된다. 화면 회전도 되고.), 텐트형, 그리고 저걸 뭐라고 하더라? 암튼 키보드를 바닥으로 받친 저런 모양도 가능하다. 생각보다는 오른쪽 사진처럼 쓸 것 같지는 않고, 책 ..

  • KnowBERT

    https://www.youtube.com/watch?v=ha6wypu8a8A&ab_channel=AIP-State-of-the-ArtAIResearch 지식베이스. 각 KB에 대해 먼저 통합 엔티 링커를 사용하여 관련 엔티티 임베딩을 검색한 다음 단어 대 어텐션 형태를 통해 컨텍스트 단어 표현을 업데이트한다. 큰 KB로 확장되는 BERT 사실적 지식 인코딩 가능성 높아짐 KAR 매커니즘으로 사전 훈련된 대형 모델에 여러 KB 삽입. 전체 KAR은 사전 훈련된 모델 두 개 사이에 삽입된다. 출력 손실 레이어를 유지하고 KAR을 교육하는 동안 레이블이 없는 말뭉치를 파인튜닝 가능. 원래 모델에 대용량 레이어를 구축함으로써 최소 추가 매개변수 및 런타임을 추가한다. 다른 위치에 추가 KB를 삽입하는 것만으로..

    2021.12.13 17:56
  • 12월 3주차 주제 - knowBERT

    https://arxiv.org/abs/1909.04164 Knowledge Enhanced Contextual Word Representations Contextual word representations, typically trained on unstructured, unlabeled text, do not contain any explicit grounding to real world entities and are often unable to remember facts about those entities. We propose a general method to embed multiple know arxiv.org http://mlgalaxy.blogspot.com/2019/12/knowledge-..

    2021.12.13 17:20
  • MERL

    Event Representation Learning: 비슷한 사건은 가까이, 다른 사건은 멀리 위치시키는 방식 3개 이벤트의 triple(주어, 목적어, 서술어) 같은 주어와 동사를 씀에도 전혀 다른 뜻을 가질 때, 혹은 반대일 때 공간에 임베딩시키기 힘들다. 임베딩을 할 당시 이미지와 triple(텍스트)를 같은 곳에 이미지를 매핑하는 기존 방식

    2021.12.08 19:24
  • 12월 8, 9, 10일 주제 - MERL

    https://ojs.aaai.org/index.php/AAAI/article/view/17695 MERL: Multimodal Event Representation Learning in Heterogeneous Embedding Spaces | Proceedings of the AAAI Conference on ojs.aaai.org https://www.youtube.com/watch?v=shnfzksjm1M 오늘 논문은 어떤 하나의 사건을 Embedding 공간안에 표현하는 방법으로 학습을 시키는 방법론, Event Representation 방법을 통해 학습을 하는 방법에 대해 소개합니다. 하나의 문장을, 주어 동사 목적어가 동일한 세개의 문장으로 표현하고, 해당 문장들로 학습을 시켰을때 매우 극..

    2021.12.06 08:00
  • Albert

    bert - training과 inference 시 memory limitation 오랜 training time 소요 factorized embedding parameterization cross layer parameter sharing으로 해결 bert: embedding size와 hidden size 동일 albert: embedding size가 hidden size보다 작음 -> hidden size는 토큰과 주변 토큰간의 관계까지 반영. hidden size가 더 많은 정보를 담고 있다. E*H matrix를 곱해줘서 input size를 h*h로 맞춰준다. albert에서는 layer의 모든 parameter를 공유한다. 1/9 수준으로 파라미터 줄어들었다. 메모리가 줄어들고(OOM 줄어..

    2021.12.06 07:58

추가 정보

인기글

최신글

TISTORY NAVER BLOG GITHUB
푸터 로고 © Magazine Lab
페이스북 트위터 인스타그램 유투브 메일

티스토리툴바