php 로 한 네이버 카페의 회원들 아이디를 추출 > 자유게시판

자유게시판

php 로 한 네이버 카페의 회원들 아이디를 추출 정보

php 로 한 네이버 카페의 회원들 아이디를 추출

본문

이게 가능한 이야기인가요??

불가능할거같은데..;
웹 크롤러와 비슷한 원리인가요?
추천
0

댓글 10개

제가 제작한게 하나있는데
php로 제작됬고요..

원리는 간단합니다.
Snoopy Class 나 CURL 로 파싱을 우선합니다.
네이버 카페측에서는 프레임을 이용하니깐 프레임 원본주소을 추출하고
페이지가 1페이지부터 999페이지 까지 파싱이 가능합니다.

전체게시물 보기시 소스보기하면 아이디가 나옵니다. 게시물 닉네임 옆에 그걸 정규식이나 explode로 짤라서 추출합니다.
그리고 뒤에@naver.com 붙이면 끝입니다.

이걸 이용해서 999~1페이지까지 돌아가면서 추출하게 합니다.
크론을 써도되고 안써도되고 딜레이 주기는 1페이지 마다 4초로 하시면될거같구요.


웹 크롤러 랑은 관계가 없는거같구요
위 방법처럼하면 어떤 카페든 추출이 가능합니다.

꼼수을 사용해서 카페api 이용해서 원하는 키워드의 카페을 추출하고
그 카페 고유번호 추출후 모든 카페의 회원 추출이 완료되면 종료하게 할수있습니다.
헐 이게 또 이렇게 하면 될수도 있겠네요..

역시 php에선 아직 제가 부족한거 같습니다 ㅠㅠ
좋은 정보 감사합니다!
만약에 막히시는 부분있으시면 말씀해주세요^^..
php 로 저렇게 해놓고 계속 리플래시 시켜놓으면 하루에 대략 10만개 이상추출가능합니다.
제가 3일간거진 50만개 추출됬더군요

거기서 stmp 지메일로 이메일 대량으로도 뿌리구있구요..
이메일 뿌릴예정이시면 이렇게하셔도 될껍니다.
한번 추출만 해보려구요 ㅋㅋ

메일을 보내기엔 좀 스팸같은 느낌이 들지 않을까요..;-;
메일 보낼지 말지 여부는 일단 추출을 해보고..

하여튼 좋은 정보 감사합니다ㅎ
아... 단순 파싱이었군요..
난 대단한 뭔가 있는줄 알고 경이의 눈으로 보고 있었는데..
좋은 정보 감사합니다.
전체 7 |RSS
자유게시판 내용 검색

회원로그인

진행중 포인트경매

  1. 참여6 회 시작24.04.25 20:23 종료24.05.02 20:23
(주)에스아이알소프트 / 대표:홍석명 / (06211) 서울특별시 강남구 역삼동 707-34 한신인터밸리24 서관 1404호 / E-Mail: admin@sir.kr
사업자등록번호: 217-81-36347 / 통신판매업신고번호:2014-서울강남-02098호 / 개인정보보호책임자:김민섭(minsup@sir.kr)
© SIRSOFT