Bekomme mit Scanner und URL keine Html-Seite ausgelesen

  • Themenstarter Themenstarter Spellsleeper
  • Beginndatum Beginndatum
S

Spellsleeper

Gast
Kann hier jemand einen Fehler ausmachen oder liegt es vieleicht auch an den Proxieinstellungen das ich kein Html ausgelesen bekomme????:L
Java:
import java.io.BufferedInputStream;
import java.io.BufferedReader;
import java.io.DataInputStream;
import java.io.InputStream;
import java.io.InputStreamReader;
import java.net.MalformedURLException;
import java.net.URL;
import java.util.Scanner;

/**
 * 
 * @author dr
 * @category HTML-Reader-Tool
 */

public class WebReader {

	

	public WebReader() {

	}

	public String readHtml(String s) {
		StringBuilder sb = new StringBuilder();
		try {
			URL url = new URL(s);
			Scanner scan = new Scanner(url.openStream());
			while (scan.hasNextLine()) {
				sb.append(scan.nextLine() + "\n");
			}

		} catch (Exception e) {
			e.printStackTrace();
		}
		return sb.toString();

	}
}
[WR]
java.net.SocketException: Connection reset

at java.net.SocketInputStream.read(Unknown Source)
at java.net.SocketInputStream.read(Unknown Source)
at java.io.BufferedInputStream.fill(Unknown Source)
at java.io.BufferedInputStream.read1(Unknown Source)
at java.io.BufferedInputStream.read(Unknown Source)
at sun.net.www.http.HttpClient.parseHTTPHeader(Unknown Source)
at sun.net.www.http.HttpClient.parseHTTP(Unknown Source)
at sun.net.www.http.HttpClient.parseHTTP(Unknown Source)
at sun.net.www.protocol.http.HttpURLConnection.getInputStream(Unknown Source)
at java.net.URL.openStream(Unknown Source)
at WebReader.readHtml(WebReader.java:28)
at TestMain.main(TestMain.java:9)

[/WR]
 
1. Wie schaut die URL aus, welche du der Methode übergibst?
2. Was genau ist die Code-Zeile 9?
3. Hast du versucht es aus und wieder an einzuschalten?

[EDIT]Wenn ich den Code ausführe kommt, wie erwartet, der Src-Code der Seite.[/EDIT]
Java:
package test;

import java.net.URL;
import java.util.Scanner;

public class WebReader
{
  public static void main(String[] args)
  {
    new WebReader ("http://www.java-forum.org/");
  }
  
  public WebReader (String s)
  {
    System.out.println (readHtml (s));
  }

  public String readHtml (String s)
  {
    StringBuilder sb = new StringBuilder ();
    try
    {
      URL url = new URL (s);
      Scanner scan = new Scanner (url.openStream ());
      while (scan.hasNextLine ())
      {
        sb.append (scan.nextLine () + "\n");
      }

    }
    catch (Exception e)
    {
      e.printStackTrace ();
    }
    return sb.toString ();

  }
}
 
Zuletzt bearbeitet:
Java:
public class TestMain {

	/**
	 * @param args
	 */
	public static void main(String[] args) {
		WebReader wr=new WebReader();
		String s=wr.readHtml("http://www.java-forum.org/" );
		System.out.println(s);
	}
}
 
Dein Code funktioniert perfekt, ich erhalte als Konsolenausgabe den Quelltext der Seite.

Es liegt dann wohl an deinem Internet.

Wo führst du den Code den aus? Eclipse?
Kannst du die Seite im Browser aufrufen (vll. ist sie gesperrt (Schule/Arbeit))?
 

Zurück
Oben