리자

스팸글 방지에 대한 고찰

요즘들어 스팸글이 난무하고 있다.
내가 보기에 스팸은 경기에 민감하다.
경기가 좋으면 스팸은 자취를 감추고, 경기가 나쁘면 스팸은 기승을 부린다.
스팸이 난무하고 있다. 그렇다면 지금의 경기는?

암튼 경기가 좋건 나쁘건 우리들은 열심히 코드를 생산해 내야하는게 임무(?) 아니겠는가?
나는 오늘도 열심히(?) 삽질을 한다.

스팸을 완전히 차단하기 위해 나는 MYSQL 의 FULLTEXT 를 사용해 보기로 했다.
http://dev.mysql.com/doc/refman/5.0/en/fulltext-natural-language.html

mysql> SELECT id, body, MATCH (title,body) AGAINST
    -> ('Security implications of running MySQL as root') AS score
    -> FROM articles WHERE MATCH (title,body) AGAINST
    -> ('Security implications of running MySQL as root');
+----+-------------------------------------+-----------------+
| id | body                                | score           |
+----+-------------------------------------+-----------------+
|  4 | 1. Never run mysqld as root. 2. ... | 1.5219271183014 |
|  6 | When configured properly, MySQL ... | 1.3114095926285 |
+----+-------------------------------------+-----------------+
2 rows in set (0.00 sec)

내용에 들어있는 자료를 검색하여 산포도를 따져 점수가 높은 것은 아예 글 등록이 되지 않도록 하는 것이다.

1. 게시글이 등록된다. 스팸글인지는 모른다.
2. 회원들이 스팸글로 신고를 한다.
3. 신고시 스팸 테이블에 해당 내용을 저장한다.
4. 다시 유사한 게시물이 등록된다.
5. 스팸 테이블에서 산포도를 검사하여 점수가 높다면 글 등록을 거부한다.

대충 이런 방법으로 구현하고자 했는데 산포도가 내가 생각하는 것처럼 나타나지 않아 포기한다. ㅜㅜ

필터링 이외에는 방법이 없는것인가?

|

댓글 3개

1. 메일 스팸을 처리하는것과 같이 공통 모듈을 실시간으로 업데이트 하는 방법
2. 블랙 IP 공유, 실시간 업데이트
3. 실시간으로 삭제.. 게시판 운영자 지정(신고글에 대해서 게시판 운영자 삭제권한 제공)
4. 스팸공동센터 운영, 센터 차원에서 스패머에 대한 법적 조치
captcha 로 막지 못하는 근본적 이유.
==> 사람이 직접 입력하면 됨.
인건비가 싼 아프리카 지역에 아르바이트 사이트를 개설하여, 캡차 인식 1건당 0.1원으로 인건비를 지급해도 할사람 많음.(하루 천원으로 1만개 등록 가능, 높게 잡아서 1원으로 해도 만원이면 1만개 등록)
(알바는 게시물 등록이 아니라, 캡차 이미지에 해당하는 문자만 입력하면 됨.)

알바 <---> 캡차이미지 사이트 <---> 등록기 로봇 <---> 캡차가 적용된 웹사이트
1. 등록기 로봇이 이미지만 추출하여 캡차이미지 사이트에 등록
2. 알바는 캡자 이미지 사이트 리스트에 등록된 이미지를 보고 문자값을 입력
(아마 한번에 10-100개 동시입력하겠죠)
3. 로봇은 캡차이미지사이트에 입력값을 확인하여, 캡차 적용된 사이트에 값을 입력하여 무력화 시킴

외국엔 이렇게 운영하는 사이트를 본적이 있음.(국내는 잘 모르겠음)

해결책.
- 사람이 벌인일은 사람이 해결하도록 해야함.. 1,2,3,4번 방법들은 모두 사람이 개입해야만 합니다.
제가 생각한 것은 스팸 DB를 만들어 비슷한 내용의 스팸글이 올라오면 사람이 올리는 경우라도 등록을 거부하는 것이었습니다.
MYSQL 의 FULLTEXT 산포도는 영문에서는 지원이 되는것 같은데 한글에서는 영 성능이 좋지 않네요.
저희 사이트에서 비회원의 글쓰기를 열어 놓았는데 전부 사람이 캡챠를 입력하고 글을 썼더라구요.
현재로서는 회원가입 이외에 뾰족한 방법이 없습니다.
댓글을 작성하시려면 로그인이 필요합니다.

프로그램

태그 필터 (최대 3개) 전체 개발자 소스 기타 mysql 팁자료실 javascript php linux flash 정규표현식 jquery node.js mobile 웹서버 os 프로그램 강좌 썸네일 이미지관련 도로명주소 그누보드5 기획자 견적서 계약서 기획서 마케팅 제안서 seo 통계 서식 통계자료 퍼블리셔 html css 반응형 웹접근성 퍼블리싱 표준화 반응형웹 홈페이지기초 부트스트랩 angularjs 포럼 스크린리더 센스리더 개발자톡 개발자팁 퍼블리셔톡 퍼블리셔팁 기획자톡 기획자팁 프로그램강좌 퍼블리싱강좌
+
제목 글쓴이 날짜 조회
15년 전 조회 1,424
15년 전 조회 1,336
15년 전 조회 1,432
15년 전 조회 867
15년 전 조회 1,569
15년 전 조회 1,184
15년 전 조회 1,479
15년 전 조회 1,680
15년 전 조회 1,467
15년 전 조회 1,605
15년 전 조회 1,289
15년 전 조회 2,132
15년 전 조회 1,222
15년 전 조회 1,595
15년 전 조회 1,671
15년 전 조회 1,872
15년 전 조회 1,046
15년 전 조회 1,757
15년 전 조회 1,627
15년 전 조회 1,313
15년 전 조회 2,352
15년 전 조회 1,460
15년 전 조회 1,401
15년 전 조회 1,611
15년 전 조회 1,383
15년 전 조회 1,587
15년 전 조회 1,556
15년 전 조회 1,189
15년 전 조회 1,907
15년 전 조회 1,912
15년 전 조회 871
15년 전 조회 891
15년 전 조회 3,345
15년 전 조회 2,267
15년 전 조회 1,366
15년 전 조회 896
15년 전 조회 897
15년 전 조회 1,365
15년 전 조회 1,658
15년 전 조회 1,535
15년 전 조회 1,331
15년 전 조회 1,566
15년 전 조회 1,304
15년 전 조회 1,833
15년 전 조회 886
15년 전 조회 1,246
15년 전 조회 870
15년 전 조회 1,350
15년 전 조회 940
15년 전 조회 1,216
15년 전 조회 927
15년 전 조회 1,183
15년 전 조회 1,449
15년 전 조회 2,966
15년 전 조회 1,283
15년 전 조회 4,674
15년 전 조회 2,158
15년 전 조회 1,468
15년 전 조회 1,698
15년 전 조회 1,571
15년 전 조회 1,953
15년 전 조회 1,859
15년 전 조회 1,174
15년 전 조회 1,701
15년 전 조회 1,064
15년 전 조회 1,179
15년 전 조회 7,191
15년 전 조회 2,544
15년 전 조회 2,184
15년 전 조회 1,204
15년 전 조회 1,489
15년 전 조회 1,341
15년 전 조회 1,995
15년 전 조회 1,743
15년 전 조회 1,309
15년 전 조회 1,129
15년 전 조회 4,593
15년 전 조회 2,959
15년 전 조회 1,302
15년 전 조회 948
15년 전 조회 1,589
15년 전 조회 1,875
15년 전 조회 1,652
15년 전 조회 1,072
15년 전 조회 2,056
15년 전 조회 3,387
15년 전 조회 1,531
15년 전 조회 1,456
15년 전 조회 1,284
15년 전 조회 1,098
15년 전 조회 969
15년 전 조회 1,060
15년 전 조회 2,229
15년 전 조회 1,274
15년 전 조회 1,650
15년 전 조회 3,860
15년 전 조회 1,566
15년 전 조회 1,720
15년 전 조회 1,426
15년 전 조회 1,410