Python 은 뉴스 제목 과 링크 를 캡 처 하 는 방법 예제 입 니 다.

1522 단어 Python정칙붙잡다
이 글 의 사례 는 Python 이 뉴스 제목 과 링크 를 캡 처 하 는 방법 을 설명 한다.여러분 께 참고 하도록 공유 하 겠 습 니 다.구체 적 으로 는 다음 과 같 습 니 다.

#-*-coding:utf-8-*-
import re
from urllib import urlretrieve
from urllib import urlopen
#      
doc = urlopen("http://www.itongji.cn/news/").read() #              
#         
def extract_title(info):
  pat = '<h3><a target=\"_blank\"(.*?)</a></h3>'
  title = re.findall(pat, info)
  titles='
'.join(title) #print titles # titles1=titles.replace('class="title"','title') titles2=titles1.replace('>',':') titles3=titles2.replace('href','url:') titles4=titles3.replace('="/','"http://www.itongji.cn/') # save=open('xinwen.txt','w') save.write(titles4) save.close() titles = extract_title(doc)
PS:여기 서 여러분 께 매우 편리 한 정규 표현 식 도구 2 가 지 를 제공 합 니 다.참고 하 시기 바 랍 니 다.
JavaScript 정규 표현 식 온라인 테스트 도구:
http://tools.jb51.net/regex/javascript
정규 표현 식 온라인 생 성 도구:
http://tools.jb51.net/regex/create_reg
더 많은 파 이 썬 관련 내용 은 본 사이트 의 주 제 를 볼 수 있 습 니 다.
본 논문 에서 말 한 것 이 여러분 의 Python 프로 그래 밍 에 도움 이 되 기 를 바 랍 니 다.

좋은 웹페이지 즐겨찾기