六狼论坛

 找回密码
 立即注册

QQ登录

只需一步,快速开始

新浪微博账号登陆

只需一步,快速开始

搜索
查看: 31|回复: 0

java中根据url抓取html页面内容的方法

[复制链接]

升级  88%

10

主题

10

主题

10

主题

童生

Rank: 1

积分
44
 楼主| 发表于 2013-2-7 15:55:05 | 显示全部楼层 |阅读模式
import java.io.BufferedReader;import java.io.InputStreamReader;import java.net.HttpURLConnection;import java.net.URL;public class URLUtil {  public static String getHtml(String urlString) {    try {      StringBuffer html = new StringBuffer();      URL url = new URL(urlString);      HttpURLConnection conn = (HttpURLConnection) url.openConnection();      InputStreamReader isr = new InputStreamReader(conn.getInputStream());      BufferedReader br = new BufferedReader(isr);      String temp;      while ((temp = br.readLine()) != null) {        html.append(temp).append("\n");      }      br.close();      isr.close();      return html.toString();    } catch (Exception e) {      e.printStackTrace();      return null;    }  }  public static void main(String[] args) {    System.out.println(URLUtil.getHtml("http://www.163.com"));  }}
您需要登录后才可以回帖 登录 | 立即注册 新浪微博账号登陆

本版积分规则

快速回复 返回顶部 返回列表