HTTP Website parsen Fehler 403

Fabse

Aktives Mitglied
Hi,

ich möchte gerne von einer Website den Quellcode parsen und damit weiterarbeiten. Habe dazu erst mal eine ganz einfache abfrage geschrieben, aber bei einigen Seiten kommt: "Server returned HTTP response code: 403 for URL:"

Danach habe ich auch gegoogelt, auch etwas gefunden, aber ich konnte davon nix vernüftig anwenden, sodass es funktioniert...hat da jemand eine simple Lösung für?

Mein Code:
Java:
import java.io.BufferedReader;
import java.io.IOException;
import java.io.InputStreamReader;
import java.net.MalformedURLException;
import java.net.URL;


public class Pars {

	public static void main(String[] args) throws Exception {

	    	URL url = null;
	        try {
	        	url = new URL("http://www.xxxxxxxxxxx.com");
	            String readLine = null;
	            String sResult = null;
	            BufferedReader buffReader = new BufferedReader (new InputStreamReader (url.openStream ()));
	            while ((readLine = buffReader.readLine ()) != null) {
	                if (sResult == null) {
	                    sResult = readLine;
	                }
	                else {
	                	sResult = sResult + readLine;
	                }                
	            }            	
	            System.out.println(sResult);        	
	        }
	        catch (MalformedURLException me) {
	        	me.printStackTrace();
	        }
	        catch (IOException ioe) {
	            ioe.printStackTrace();
	        }

	}

}

Gruß und Danke 🙂
 

Neue Themen


Zurück
Oben