Скрипт парсер.

Discussion in 'PHP' started by mmda, 28 Jan 2009.

  1. mmda

    mmda Banned

    Joined:
    25 Dec 2008
    Messages:
    0
    Likes Received:
    0
    Reputations:
    0
    Нужен парсер, что бы из http://сайт.com/administrator/components/com_extcalendar/

    Получилось сайт.com,тоесть оставлял только домен а всё остальное после него удалял.
     
    #1 mmda, 28 Jan 2009
    Last edited: 28 Jan 2009
  2. 159932

    159932 Elder - Старейшина

    Joined:
    28 Sep 2007
    Messages:
    587
    Likes Received:
    462
    Reputations:
    5
    preg_match('#[a-z]{1,}\.[a-z\.]{1,}#i',$url);
    ну или
    preg_match('#http:\/\/(.*?)\/#i',$url);
    ну вариантов многовато..
     
  3. mmda

    mmda Banned

    Joined:
    25 Dec 2008
    Messages:
    0
    Likes Received:
    0
    Reputations:
    0
    :) можеш катануть на перле или пхп?
     
  4. 159932

    159932 Elder - Старейшина

    Joined:
    28 Sep 2007
    Messages:
    587
    Likes Received:
    462
    Reputations:
    5
    <?php
    $text = file_get_contents('a.txt');
    preg_match_all('#http:\/\/(.*?)\/#i',$text,$urls);
    foreach($urls[1] as $fuk) echo $fuk."\n";
    ?>
     
  5. mmda

    mmda Banned

    Joined:
    25 Dec 2008
    Messages:
    0
    Likes Received:
    0
    Reputations:
    0
    Парсит домены, но выводит список такого вида, www.сайт.hk www.сайт.com www.сайт.com
    В одной строке.Нужно чтобы каждый домен на отдельной строке был.
     
  6. 159932

    159932 Elder - Старейшина

    Joined:
    28 Sep 2007
    Messages:
    587
    Likes Received:
    462
    Reputations:
    5
    однако глянь сурс чтоли браузера чтоле.
    или поменяй echo $fuk."\n"; на echo $fuk."<br>";
     
  7. De-visible

    De-visible [NDC] Network develope c0ders

    Joined:
    6 Jan 2008
    Messages:
    916
    Likes Received:
    550
    Reputations:
    66
    PHP:
    #  Link parser
    #  Author: De-visible
    #  ICQ#:223333575
    #  Mega - Script
    import re

    file_name 
    "text.txt"
    out_file "out.txt"
    = []

    with open(file_name) as txt:
        
    with open(out_file,'w') as outf:
            for 
    line in txt:
                
    outf.write(str(re.findall(r'http:\/\/(.*?)\/',line))[2:-2]+"\n")
            print 
    "completed"
     
  8. mmda

    mmda Banned

    Joined:
    25 Dec 2008
    Messages:
    0
    Likes Received:
    0
    Reputations:
    0
    Спасибо огромное ;)
     
  9. De-visible

    De-visible [NDC] Network develope c0ders

    Joined:
    6 Jan 2008
    Messages:
    916
    Likes Received:
    550
    Reputations:
    66
    Скрипт на Python написан, если что:)
     
  10. diehard

    diehard Elder - Старейшина

    Joined:
    30 Sep 2007
    Messages:
    442
    Likes Received:
    266
    Reputations:
    15
    кагбе мануал читайте иногда

    PHP: parse_url()