안녕하세요. 현재 게임업계에서 약 5년간 데이터 엔지니어와 분석가로 근무하며 Hadoop, Hive SQL, Python 기반 로그 수집·적재, 품질 검증, 이상 모니터링 업무를 해왔습니다. 반도체 경험은 없지만 반도체 업계에서 일해보고 싶어서 삼성전자 DS·SK하이닉스 데이터 직무로 이직을 준비 중입니다. 평가·분석 강의가 저 같은 비전공·타 산업 경력자에게도 적합한지, 수강 후 실제 직무 전환 가능성이 있는지 여쭙고 싶습니다.
현재 작업형1 강의를 다 듣고 연습문제도 두번씩 풀었는데 (아직 혼자 해결은 안 됩니다..ㅜ) 작업형1을 완벽히 이해하고 넘어가야 할지 아니면 작업형2, 작업형3을 빠르게 모두 학습하고 남은 시간 동안 한번에 익혀야 할지 어떻게 하면 좋을까요? 조언 부탁드립니다 감사합니다.
문서에서 텍스트를 추출해서 벡터 DB를 구축한 뒤 검색하는 RAG 시스템을 공부하고 있습니다. 지금 고민은 표 같은 2차원 데이터를 LLM이 인식하도록 구현하는 부분입니다. 문서에 포함된 표를 JSON형태로 만들어 모델의 입력으로 집어 넣어야 한다고 알고 있습니다만, 이 변환 방법에 대해 많은 고민을 하는 중입니다. OCR을 사용하는 것도 고려중입니다만, OCR을 이용해 가능한 기능이 텍스트 추출까지인지, 인식한 텍스트를 특정 양식으로 변환까지 가능한 건지 이 부분도 궁금합니다. (단순 텍스트 추출까지만 가능하다고 하면 리소스 최소화 측면에서 Computer Vision으로 극복하고 NLP나 RAG 구현에 집중하고 싶습니다.) 혹시 이 부분을 해결하신 경험이 있다면 많은 조언 부탁드립니다.
안녕하세요, 현업에서는 PHP, Java를 주로 다루고 있는 개발자입니다. 요 근래 LLM, RAG, LangChain 등 지능형 챗봇이라던지 AI Agent를 개발하기 위한 기술들에 대한 관심이 있었지만 이쪽 분야에 지식이 없다보니, 이것저것 알아보던 중 반가운 소식을 맞이하게 되었습니다. 아무래도 AI쪽과 관련된 개발은 Python을 주로 다루는 것 같더라구요. 그래서 현재 업무 외 시간에 Python을 학습중에 있는데, 어느정도 레벨이 되어야 이번에 출판될 책을 구매 후 읽었을 때 이해도 수월하고, 손 쉽게 따라서 코딩할 수 있을지 궁금합니다. (저의 목표 중 하나는 PHP, Java로 개발된 서비스에 Python으로 개발한 지능형 챗봇(Ex. 유저의 질문의 맥락을 파악하여 유사한 홈페이지 컨텐츠 찾아주는 봇 등...)을 연동시키는데 있습니다.) 그리고 이런 분야는 데이터분석, 빅데이터 영역과는 별개의 영역인지도 궁금합니다! 지식이 얕아 질문의 내용이 다소 미흡하더라도 너그러운 양해 부탁드립니다. [제이쓴님 출판 공지...] https://inf.run/E4Ea7
고등학교 IT과 재학중인 17살 고등학생입니다. AI서비스 개발 관련 관심이 생겨서 강의를 구매하고 보고있어요. 1강부터 5강까지 보았는데, 내용이 이해가 안됩니다. 예를 들어 강사님이 혼자 코드를 짜시는 걸 보면, 설명을 안해주시고 넘어가시는 부분, 그리고 강사님이 하는 방법을 따라하고 싶지만 제가 부족해서 못 따라하는 부분 등등.... 강사님 잘못이라는 게 아니라, 이런 부분에서 이 강의를 듣기전에 먼저 공부 후 이 내용을 다시 들어야 이해가 될 것 같습니다. 공부를 무슨 공부를 해야하고, 강의 관련 좋은 강의도 있으면 추천도 부탁드립니다. 강의 내용은 수강평 보면 정말 좋은 것 같아요. 그래서 더 제대로 배우고 싶습니다. 이 강의를 이해하려면 사전에 무슨 공부를 해야하고 어떻게 해야하는 지 자문을 구하고싶습니다!!
안녕하세요 선생님. 우선 좋은 강의 감사드립니다. 저는 회사에서 백오피스 서비스의 백엔드 개발을 담당하고 있으며, 현재 유지보수 중인 서비스를 개선하기 위해 WebFlux 공부를 시작하게 되었습니다. 저희 백오피스의 주요 패턴은 다음과 같습니다. 사내 사용자가 특정 데이터를 일괄 선택하여 API 호출 백엔드에서 해당 데이터를 조회 조회한 데이터를 기반으로 외부 API를 순차 호출 성공/실패 결과를 집계하여 응답 반환 즉, “여러 건 조회 후 순차적으로 외부 API를 호출하는” 동기적 패턴이 많습니다. 이를 개선하기 위해 MQ 도입 (SQS, Kafka), Spring @Async , 기존 코드를 WebFlux 라이브러리로 마이그레이션 위 3가지 사항을 후보로 고민해보았습니다. 여기서 제가 가장 궁금한 점은 다음 두 가지입니다. WebFlux를 이런 백오피스 일괄 작업 처리 에 적용하는 것이 적절한 선택일까요? 만약 적용한다면, 최대한의 성능을 낼 수 있는 활용 방식 은 어떤 방향일까요? 예를 들어, 외부 API를 병렬로 호출한 뒤 완료되는 대로 text/stream 형태로 프론트엔드에 전달하는 구조를 시도해보고 싶습니다. 이런 접근이 합리적인지, 혹은 더 나은 패턴이 있을지 선생님의 의견을 듣고 싶습니다.
지금 빅데이터 분석 기사 실기 준비중인 학생입니다. 전에 수강 신청 후 다시 강의를 듣는 중 강의 기간이 오늘까지라 시험 전까지 복습하고 싶은데 재결재를 하기에는 너무 부담스러워서 혹시 수강 연장을 할 수 있는지 궁금하여 글 작성합니다. 너무 좋은 강의 항상 너무 감사드리고 꼭 이번에 합격하고 싶습니다!
6월 21일 10회 실기 시험 보는 수험생입니다! 현재 캐글에 올라와있는 작업형2 예상문제랑 컴피티션은 오류 없이 csv 만들 수 있는 상태입니다. 이 정도만 해도 시험에서 2유형은 무리가 없을지 궁금합니다. 그리고 2유형에서 전처리하는 정도로만 데이터를 다룰 수 있는데, 1유형을 더 집중해야할지, 3유형에 올인할지 고민입니다ㅜㅜ 조언 부탁드립니다. 감사합니다.