[실전]텍스톰 TEXTOM 실전 강의: 빅데이터 논문 작성을 위한 텍스트 분석/텍스트마이닝
N-gram 분석은 N개 단어의 연쇄를 확률적인 수치를 산출하고 시각화하는 방법으로 대용량의 문서에서 특정 단어 뒤에 위치하는 단어나 음절의 빈도를 정량적인 수치로 나타낼 수 있다(Kang & Lee, 20019). 단어 간 연결방향이 화살표를 통해 시각화되며 화살표의 굵기 크기를 통해 연결강도가 결정된다(Yoo et al., 2019). 또한 연관 단어 간 관계성을 분석하면 단어간 관계 파악에 용이다하다(Kim, 2020). 본 연구에서는 Textom에서 제공하는 N-gram 텍스트마이닝 기법 시 데이터의 흐름과 이해를 하기 위해 가장 먼저 기초 분석 자료로 활용되는 기법이기도 하다. 단어빈도에 기반한 분석은 전체 문서 내에서 특정 단어의 풀현 빈도를 나타낸다. 문서 내에 특정 단어가 등장하는 횟수를 나타내며 이수치값이 클수록 문서에서 자주 사용하는 단어임을 의미한다(Jang et al.,2018). 높은 출현 빈도를 나타내는 단어는 대체로 연구주제와 관련된 함축된 의미를 내재하고 핵심 단어로 작용 할 수도 있다(Lee,2022).
분류(Classification) 성능 평가지표 개요와 정확도(Accuracy) 소개 에서 MNIST를 모두 0으로 예측하는 코드에서 fakepred와 y_test를 비교하는데요 이때 type은 같은데 하나는 1차원 배열이고 또 다른 하나는 column을 1로 가진 2차원 배열인데 이렇게 shape이 달라도 accuracy_score를 통해 비교할 수 있나요?
함수에 대해 정의내릴 때 예를 들어 코랩 에서는 scaler = minmax_scale() 이렇게 정의를 내리고 scaler(data) 하는데 #코랩은 정의내릴 때 괄호를 빼면 동작안함 구름에서 테스트해보니까 scaler = minmax_scale()하고 scaler(data)하면 에러가 발생하고 괄호없이 scaler = minmax_scale 만해야 에러가 발생하지 않더라구요. 이게 구름 환경만의 특성이라서 그렇다고 보면 될까요?
안녕하세요 선생님. 우선 좋은 강의를 해주셔서 감사드립니다. 다름이 아니라 현재 섹션1,2 를 수강한 상태입니다. 섹션 1, 2를 수강하는데 수식이 굉장히 많이 등장하더라구요. 제가 수포자였어서 현재로썬 이해하는데 있어서 어려움이 많은 상태입니다.(지금은 열심히 공부하고 있습니다! 아무래도 딥러닝을 공부하는데 수학이 필수인거같아서) 그래서 작동 원리만 이해하고 우선은 넘어가는 방식으로 공부하려고 하는데 이렇게 해도 괜찮을까요?? 예를들면 경사하강법은 손실함수의 기울기가 적어지는 방향으로 학습하는 것이구나, 오차역전파는 미분을 거꾸로 하면서 가중치를 업데이트하는 것이구나, 손실함수는 이런게 있구나, 옵티마이저는 이런게 있구나 이렇게 작동하는구나 이런식으로요. 물론 언젠가는 반드시 다 이해해야겠지만 딥러닝입문자로써는 이렇게 이해만 하고 넘어가도 될까요??
[리뉴얼] 처음하는 파이썬 머신러닝 부트캠프 (쉽게! 실제 캐글 문제 풀며 정리하기) [데이터분석/과학 Part2]
train.corr().iplot(kind='heatmap', colorscale='Blues') 현재 위의 코드 수행시 에러가 발생하는데요. ValueError: could not convert string to float: 'Braund, Mr. Owen Harris' train 데이터프레임에서 문자열 데이터가 포함되어 있기 때문에 해당 에러가 발생할 수 있습니다. 이 경우, 상관 관계 행렬을 계산하기 전에 문자열 열을 제거해야합니다. 저의 경우 다음처럼 새로운 객체를 만들어 진행하였습니다. object_cols = train.select_dtypes(include=['object']).columns #열의 데이터 타입이 문자인녀석 추출 new_train = train.drop(columns=object_cols) # 열의 데이터가 문자열인 것들 제거 후 새로운 객체에 생성 new_train.corr().iplot(kind='heatmap', colorscale='Blues') 이러면 잘 나옵니다.
[리뉴얼] 처음하는 파이썬 머신러닝 부트캠프 (쉽게! 실제 캐글 문제 풀며 정리하기) [데이터분석/과학 Part2]
import plotly.io as pio pio.renderers.default='iframe' 다음 코드를 추가해주시면, iframe 을 통해 렌더링 됩니다. 저의 경우 다음 에러로 렌더링이 안됐습니다. ( F12 / Option+Command + i -> console 에서 확인 가능 .)
<강의 코드> transforms_for_train = transforms.Compose( [ transforms.Resize(feature_extractor.size), transforms.RandomHorizontalFlip(), transforms.ToTensor(), normalize, ] ) 강의 코드를 변경하지 않고 그대로 실행하면 아래와 같은 오류가 발생합니다 <오류 메시지> TypeError: Size should be int or sequence. Got <해결 방법> feature_extractor.size를 tuple(feature_extractor.size.values()) 로 변경한 뒤 실행합니다. transforms.Resize 내의 인자 뿐만 아니라 Crop 안의 인자도 함께 변경해주어야 합니다 transforms_for_train, transforms_for_val 모두 동일하게 변경한 뒤 실행하면 에러 없이 실행되는 것을 보실 수 있습니다.
쉽게 처음하는 파이썬 고급 크롤링 [Scrapy, Selenium, Headless Chrome]
안녕하세요 저는 비전공자이고 풀스택 전과정 + 고급 크롤링 강의를 듣고있는 수강생입니다. 우선 너무 좋은 강의 정말 잘 듣고 있습니다. 저는 코딩을 아예처음 접하고있어서 어느쪽으로 가고싶은지 전혀 갈피가 없었는데요. 하다보니 데이터과학이 제가 하고싶었던 분야라는것을 알게되었습니다. 항상 외주로 개발자를 구해서 돈을 주고 프로그램을 제작하는것을 자주해왔는데요. 개발비로도 2000만원이상을 쓴것 같습니다. 그런데 제가직접 해보고자 이곳을 찾아왔고, 데이터 과학이 제가 생각한 분야라는것을 고급크롤링 강의들으면서 알게되었습니다. 그런데 궁금한점은 개발자에게 외주를 맡기면서 항상 GUI 방식의 프로그램을 받아서 그것으로 크롤링 및 자동화 프로그램들을 주로 외주를 맡겨왔었는데요. 강의 내용을 계속보고있는데 GUI 에 관한건 없더라구요. 제가 못찾는건지 별도 다른강의가 있는건지 알고싶습니다. 저는 GUI에 자동화 소스를 버튼처럼만드는 그런 프로그램을 만들고 싶거든요 ! 강의내용의 질문은 아니지만, 그 강의가있다면 추가로 구매해서 수강하고싶습니다. 답변 부탁드립니다
figure, ax_list = plt.subplots(nrows=3, ncols=5) figure.set_size_inches(20,20) for i in range(len(full_column_list)): sns.regplot(data=boston_house_df, x=full_column_list[i], y='PRICE', ax=ax_list[int(i/5)][int(i%5)]) ax_list[int(i/5)][int(i%5)].set_title("regplot " + full_column_list[i]) 안녕하세요 수업 즐겁게 듣고 있습니다 : ) 여기서 ax = ax_list 부분 설명 좀 부탁 드리겠습니다. 만약 i를 안쓰고 개별 1개 칼럼에 대해 그래프를 그린다면 ax = 뒤가 뭔지 궁금합니다. 이것만 알아도 위 코드가 이해될 것 같습니다. 감사합니다.
그랩님 새해 복 많이 받으세요. 마케팅 6년차 일반직무에서 근무하고 있는데, 프론트엔드 개발자로 커리어 전환을 꿈꾸고 있는데요. 나이는 33살입니다. 퇴사를 하고 온전히 부트캠프를 통해서 프론트엔드 개발자로 커리어 전환을 시도해보고자 하는데요. 혹시 인프런 강의를 통해서 혼자 진행해보는게 나을지, 부트캠프를 통해 짜여진 커리큘럼을 통해서 진행하는게 나을지 문의 드립니다. 온전히 9-6를 개발 공부에 할애 할 수 있는 상황인데요. 기간은 6개월 정도로 생각하고 있습니다. 혹시 짧은 조언이나 얻어볼 수 있을까요..!
안녕하세요. 과학기술정보통신부 주관 지역ICT이노베이션스퀘어 확산사업 으로 블록체인 고급 프로젝트 과정 개발 교육 진행중입니다. 수강혜택으로 수료증발급, 블록체인 자격증 응시 기회까지 제공해드리고 온라인수강, 전액무료, 누구나 과정을 이수할 수 있으니 신청해보세요. 학생, 취업준비생, 재직자, 이직자 예정자분들 병행 추천드립니다! https://blog.naver.com/kjc_sh/222852299901
[가짜연구소 컨퍼런스, 4th PseudoCon] 가짜연구소에서는 이번에 "함께하는 힘"이라는 주제로 컨퍼런스를 진행합니다! 관련주제로 초대하여 발표하는 invited talks와 가짜연구소의 아카데미 활동(스터디/크루/펠로우쉽)을 발표하는 contributed talk, 그리고 새로운 팀을 만들 수 있는 기회를 갖는 네트워킹까지! 누구나 참여하실 수 있으니 주저말고 오셔서 함께하는 힘, 공유, 동기부여, 함께하는 즐거움의 가치를 누리세요!! 특별히 이번 행사는 정보통신산업진흥원(NIPA)과 Google Cloud의 후원을 받아 진행됩니다. 아쉽게도 행사는 온라인으로 진행되지만, 발표자들과 기여자들은 Google for Startups의 공간에서 진행하게 됩니다! Google의 후원을 받는 날이 오다니이이 정말 기쁩니다!! :) 비영리 머신러닝 커뮤니티 가짜연구소의 4기(2022년 상반기)에는 총30여개의 그룹, 350여명이 함께 성장하며 가짜연구소의 가치를 실현해나가고 있습니다. 이번 기수에서는 삼성서울병원에서 외과의사로 근무하시는 남기님이 <CV in Surgery>팀을, Graph 관련 팀만 벌써 3번이나 이끄신 수민님의 <Groovy Graph>, 무료 튜토리얼을 자주 열어주시는 mlops 전문가 정훈님의 <ml-with-the-flow> 등 다양하고 흥미로운 주제를 기반으로 스터디와 연구개발이 이루어졌습니다! 케글 메달들과 인공지능 경진대회 우승, 70여명이 참여한 오프라인 네트워킹 파티, 다양한 튜토리얼과 쿡북, 스터디 자료와 논문 리뷰 등이 이루어졌습니다. 앞으로는 "비영리 연구"의 새로운 무브먼트를 만들기 위해 조직을 재구성하려합니다! 그러한 발표도 할 예정이니 기대해주세요!! 신청 링크: https://event-us.kr/pseudolab/event/45800 행사 정보: https://pseudo-lab.com/5aa0d71c7e7749de9545222f12c61c5e?v=32ac5977503c40618e3bdcac0035dd20&p=bdde093d551e4b59988eccaceb8ac41c 가짜연구소 디스코드 커뮤니티: https://discord.gg/EPurkHVtp2 --- 이 바쁘고 복잡한 세상에서 홀로 공부하는 것은 매우 힘이듭니다. 쏟아지는 정보를 홀로 감당하기 힘들 뿐더러, 바쁜 일상 속에 홀로 의지내어 목표 지점까지 완주하는 것은 참 어렵습니다. 그런데, 함께함은 어려운 일이 아니라, 상대적으로 쉬운 일입니다. 어떠한 작은 움직임이, 참여가, 소통이 축적되어 여러분의 삶을 크게 변화시킬 것을 기대해보세요! 단순히 혼자 공부하는 것을 함께함으로 효율적이 되는 것 뿐만 아니라, 약한 의지도 강하게 만들고, 하나의 목표를 끝까지 끌고나가 목표까지 달성하고, 같은 분야에서 오래 함께 소통하는 가짜연구소의 이야기를 들어보고 싶으시지 않으신가요? 여러분들의 참여는 거창할 필요 없습니다. 준비될 필요 없습니다. 서로에게 의지할 수 있도록 오히려 내려놓고 부족함을 인정하십시오! 그리고 함께함으로 부족함을 채워나가 끝까지 완주함으로 걸어온 발자취를 뒤돌아보며, 함께 얘기할 수 있는 동료가 있다면 얼마나 행복할까요. 여러분들의 성장 과정이 스트레스나 고통이 아닌 스토리와 즐거움이 가득하기를 바랍니다!
안녕하세요 인공지능팩토리 커뮤니티매니저입니다. 여름은 일 년 중 가장 뜨겁고 무더운 계절이기도 하지만 가장 화창하고 푸르른 계절 중 하나이기도 합니다. 시원한 바다와 음료가 생각나기도 하구요 여러분은 어떻게 여름을 보내실 지 계획을 세우셨나요? 이번 여름을 저희 AIFactroy와 함께 보내실 수 있도록 경진대회 소식을 준비해봤습니다 이번 대회는 바로 롯데멤버스 채용특전과 더불어 총 상금 1,000만원이 걸린 "(채용 특전) 제7회 롯데멤버스 빅데이터 경진대회"입니다! 주제는 고객 구매 데이터에 기반한 예측 모델 개발 및 개인화 마케팅 전략을 제안하는 것입니다. 여러분의 역량을 펼치어 좋은 결과로 이어지길 응원하겠습니다~ 롯데멤버스 경진대회 1634×336 132 KB 공모 주제 : 고객 구매 데이터에 기반한 예측 모델 개발 및 개인화 마케팅 전략 제안 기간 및 일정 (UTC+ 9(한국) 기준) 참가신청 : 2022. 6. 2. (목) ~ 2022. 7. 3. (일) 24:00 데이터 다운로드 및 분석결과물 제출 : 2022. 6. 20. (월) ~ 2022. 8. 12. (금) 24:00 사전설명회 : 2022. 6. 29. (수) 16:00 참가신청서 https://forms.gle/9zDNGE1rhKfEFmrH7 상금 및 채용특전 (총 상금 1,000만원 + 채용특전) 대상 1팀 : 500만원 최우수상 1팀 : 200만원 우수상 3팀 : 각 100만원 장려상 3팀 : 각 L.POINT 30만 P ※ 우수상 이상 수상팀 참여인원 대상, 22~23년 데이터 유관 직무 신입/인턴 지원 시 서류전형 1회 면제 참가대상 엘포인트 회원 : 국내/해외 대학생 및 대학원생, 대학교 졸업 후 2년 이내의 미취업자 개인 또는 팀 (최대 3인) 문의 : 인공지능팩토리: cs@aifactory.page 대회 상세 보기 [ AIFactory ] AF_포스터 618 1070×1511 146 KB 하는 문화를 만들어가요. - 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요.