-
Re: Zoekmachines
Daniel Tryba wrote:
> John Bokma <postmaster@castleamber.com> wrote:
>
>>Welke URL is nu mooier voor een gebruiker?
>>
>>/showpage?id=13131547
>>
>>of
>>
>>/fotos/vakanties/1999/srilanka/
>
> Boeit de gebruiker geen ruk, die gaat geen van beide inkloppen.
Wat was dan je punt? ("Hoe was het advies ook alwerr in niwo: maak
paginas voor gebruikers, niet voor searchengines.")
Overigens, het boeit sommige gebruikers wel degelijk. Die doen aan URL
hacken.
Ik verwacht op /fotos/vakanties/ een mooie overzichtspagina met
vakanties :-D.
--
John MexIT: http://johnbokma.com/mexit/
personal page: http://johnbokma.com/
Experienced Perl programmer available: http://castleamber.com/
-
Re: Zoekmachines
Daniel Tryba wrote:
>> /showpage?id=13131547
>>
>> of
>>
>> /fotos/vakanties/1999/srilanka/
>
> Boeit de gebruiker geen ruk, die gaat geen van beide inkloppen.
Deze gebruiker wel, veel links worden bv als tekst opgeslagen, soms zonder
beschrijving. Url's als de 2e zijn veel makkelijker te begrijpen als je ze
weer eens tegenkomt. Ook in je history of een logfile etc zijn urls van de
2e soort veel makkelijker.
Omgekeerd zijn kortere urls makkelijker te typen en te onthouden. (En jawel,
ik typ heel wat urls)
--
Inca
-
Re: Zoekmachines
John Bokma <postmaster@castleamber.com> wrote:
>>>Welke URL is nu mooier voor een gebruiker?
>>>
>>>/showpage?id=13131547
>>>
>>>of
>>>
>>>/fotos/vakanties/1999/srilanka/
>>
>> Boeit de gebruiker geen ruk, die gaat geen van beide inkloppen.
>
> Wat was dan je punt? ("Hoe was het advies ook alwerr in niwo: maak
> paginas voor gebruikers, niet voor searchengines.")
Dus is de vorm van de url irrelevant. De inhoud blijft het zelfde en
een searchengine zou dus geen verschillen moeten opleveren.
> Overigens, het boeit sommige gebruikers wel degelijk. Die doen aan URL
> hacken.
Kunnen ze in voor de eerste url mooi alle combinaties van 1 tot
maxint gaan uitvoeren en voor de 2de een zooi datums en landen.
> Ik verwacht op /fotos/vakanties/ een mooie overzichtspagina met
> vakanties :-D.
Dat zou ik bij een showpage utl zonder argument ook verwachten.
--
Daniel Tryba
-
Re: Zoekmachines
Inca <shadow*movements@wanadoo.nospam.invalid> wrote:
>> Boeit de gebruiker geen ruk, die gaat geen van beide inkloppen.
>
> Deze gebruiker wel, veel links worden bv als tekst opgeslagen, soms zonder
> beschrijving.
Dat doe ik ook, over het algemeen als bookmarks in een browser of in een
tekstfile met een zinnige naam. Ik heb dan ook het gevoel dat je het
jezelf erg lastig maakt als je een boel links in nietszeggende files
zonder beschrijving opslaat.
--
Daniel Tryba
-
Re: Zoekmachines
John Bokma <postmaster@castleamber.com>, you wrote on Tue, 27 Apr 2004
15:36:55 -0500:
>Daniel Tryba wrote:
>> John Bokma <postmaster@castleamber.com> wrote:
>>
>>>Welke URL is nu mooier voor een gebruiker?
>>>
>>>/showpage?id=13131547
>>>
>>>of
>>>
>>>/fotos/vakanties/1999/srilanka/
>>
>> Boeit de gebruiker geen ruk, die gaat geen van beide inkloppen.
>
>Wat was dan je punt? ("Hoe was het advies ook alwerr in niwo: maak
>paginas voor gebruikers, niet voor searchengines.")
>
>Overigens, het boeit sommige gebruikers wel degelijk. Die doen aan URL
>hacken.
>
>Ik verwacht op /fotos/vakanties/ een mooie overzichtspagina met
>vakanties :-D.
En als ik www.vakantiefotoman.nl in mijn browsert intypt, dan vult-ie
dat aan tot ofwel /showpage?id=13131547, ofwel
/fotos/vakanties/1999/srilanka/. Alleen aan dat laatste kan ik zien
"oh ja, dat was dat leuke danseresje".
--
branko collin
- dr: "have you been exposed to any user interfaces designed by engineers?"
- woman: "yes"
- dr: "you have interface poisoning. you'll be dead within a week" (scott adams, dilbert)
-
Re: Zoekmachines
Daniel Tryba wrote:
> John Bokma <postmaster@castleamber.com> wrote:
>
>>>>Welke URL is nu mooier voor een gebruiker?
>>>>
>>>>/showpage?id=13131547
>>>>
>>>>of
>>>>
>>>>/fotos/vakanties/1999/srilanka/
>>>
>>>Boeit de gebruiker geen ruk, die gaat geen van beide inkloppen.
>>
>>Wat was dan je punt? ("Hoe was het advies ook alwerr in niwo: maak
>>paginas voor gebruikers, niet voor searchengines.")
>
> Dus is de vorm van de url irrelevant.
*zucht*, lees je wel, het is je nu door meer dan 1 persoon duidelijk
gemaakt dat de VORM van de URL wel degelijk relevant is. Sterker, de 2e
vorm is niet alleen voor Google handiger, ook voor een (klein) aantal
gebruikers die wel degelijk iets met de URL doen.
> De inhoud blijft het zelfde en
> een searchengine zou dus geen verschillen moeten opleveren.
Ja, *zou*. Echter, o.a. Google maakt wel degelijk onderscheid. En hoe
maak jij je websites? Op wat *zou* moeten, of de werkelijkheid?
>>Overigens, het boeit sommige gebruikers wel degelijk. Die doen aan URL
>>hacken.
>
> Kunnen ze in voor de eerste url mooi alle combinaties van 1 tot
> maxint gaan uitvoeren en voor de 2de een zooi datums en landen.
En wat is zinniger denk je? Gok eens waarom domeinnamen gebruikt worden,
ipv IP nummers?
>>Ik verwacht op /fotos/vakanties/ een mooie overzichtspagina met
>>vakanties :-D.
>
> Dat zou ik bij een showpage utl zonder argument ook verwachten.
Nee, daar zou ik in dit geval een overzicht van foto's verwachten,
waaronder vakanties :-D.
--
John MexIT: http://johnbokma.com/mexit/
personal page: http://johnbokma.com/
Experienced Perl programmer available: http://castleamber.com/
-
Re: Zoekmachines
John Bokma <postmaster@castleamber.com> wrote:
>> Dus is de vorm van de url irrelevant.
>
> *zucht*, lees je wel,
Ja ik lees, maar jij bent mijn opmerkingen allang weer vergeten.
> het is je nu door meer dan 1 persoon duidelijk
> gemaakt dat de VORM van de URL wel degelijk relevant is.
Hoe is voor google de vorm van de url relevant!
>> De inhoud blijft het zelfde en
>> een searchengine zou dus geen verschillen moeten opleveren.
>
> Ja, *zou*. Echter, o.a. Google maakt wel degelijk onderscheid. En hoe
> maak jij je websites?
Ik maak helemaal geen websites. De laatste is almeer dan 3 jaar geleden.
> Op wat *zou* moeten, of de werkelijkheid?
Tot de frustratie van de project manager maakt ik dingen zoals ze zouden
moeten werken. Ik ga geen bugs van andere fixen.
>>>Overigens, het boeit sommige gebruikers wel degelijk. Die doen aan URL
>>>hacken.
>>
>> Kunnen ze in voor de eerste url mooi alle combinaties van 1 tot
>> maxint gaan uitvoeren en voor de 2de een zooi datums en landen.
>
> En wat is zinniger denk je?
Geen van beide is zinnig. Als mensen zomaar urls gaan verzinnen zal ik
ze niet tegenhouden.
> Gok eens waarom domeinnamen gebruikt worden, ipv IP nummers?
Ik neem aan dat je hostnames bedoelt. Maar goed, ik ken alle voor mij
belangrijke ip nummers ook wel uit mijn hoofd, heel handig als er weer
eens iets mis is met dns.
Maar je ziet nu even over het hoofd dat we het over zoekmachines hebben.
Daar boeit de vorm van hostname niet. Gebruiker klopt iets in en hij
krijgt een lijstje URI met samenvatting. De gebruiker clickt op een URI
en ziet het resultaat. Voor het resultaat maakt het niet uit vor de
hostname in numerieke vorm is of als FQDN. Voor het resultaat maakt het
ook niet uit de request nu /foo?bar=3428364 was of /foo/bar/3428364
of /fiets/bel/moertje.
Zullen we nu weer even iets uit het begin van de thread oppakken:
Hoe denkt google dynamische urls te herkennen? Ze gebruiken als argument
dat ze de website problemen besparen door minder met dynamische urls te
doen. Als reactie verzinnen ontwikkelaars dus manieren om deze
eigenaardigheid te omzeilen en dus is alle moeite van google voor neits
geweest.
>>>Ik verwacht op /fotos/vakanties/ een mooie overzichtspagina met
>>>vakanties :-D.
>>
>> Dat zou ik bij een showpage utl zonder argument ook verwachten.
>
> Nee, daar zou ik in dit geval een overzicht van foto's verwachten,
> waaronder vakanties :-D.
Wellicht :)
--
Daniel Tryba
-
Re: Zoekmachines
Daniel Tryba wrote:
> Ik heb dan ook het gevoel dat je
> het jezelf erg lastig maakt als je een boel links in nietszeggende
> files zonder beschrijving opslaat.
Ik sla ze dan ook /zelf/ meestal niet op zonder beschrijving als ik de keuze
heb. Maar weet je, ik heb niet altijd de keuze. En ik ervaar dat ik vaak
url's tegenkom waarvan ik geen idee heb wat het is, en dat het dan
makkelijker is om een 'leesbare' url te hebben. En dus interesseert het mij,
als gebruiker, wel. En dus klopt jouw stelling dat het de gebruiker niets
interesseert, niet.
--
Inca
-
Re: Zoekmachines
Daniel Tryba wrote:
> John Bokma <postmaster@castleamber.com> wrote:
>
>>>Dus is de vorm van de url irrelevant.
>>
>>*zucht*, lees je wel,
>
> Ja ik lees, maar jij bent mijn opmerkingen allang weer vergeten.
Welnee, want die blijf je tot in den treure herhalen, terwijl al
meerdere malen duidelijk is gemaakt wat er mis is.
>> het is je nu door meer dan 1 persoon duidelijk
>>gemaakt dat de VORM van de URL wel degelijk relevant is.
>
> Hoe is voor google de vorm van de url relevant!
De ene vorm ziet Google als dynamisch, de andere als statisch.
"1. Reasons your site may not be included.
* Your pages are dynamically generated. We are able to index
dynamically generated pages. However, because our web crawler can easily
overwhelm and crash sites serving dynamic content, we limit the amount
of dynamic pages we index.
"
Maar ik vrees dat je het nog steeds niet begrijpt.
>>>De inhoud blijft het zelfde en
>>>een searchengine zou dus geen verschillen moeten opleveren.
>>
>>Ja, *zou*. Echter, o.a. Google maakt wel degelijk onderscheid. En hoe
>>maak jij je websites?
>
> Ik maak helemaal geen websites. De laatste is almeer dan 3 jaar geleden.
Dat is meer dan duidelijk.
>>Op wat *zou* moeten, of de werkelijkheid?
>
> Tot de frustratie van de project manager maakt ik dingen zoals ze zouden
> moeten werken. Ik ga geen bugs van andere fixen.
Bord voor je kop methode, dat werkt uitstekend bij o.a. websites maken.
Alle browsers hebben bugs.
>>En wat is zinniger denk je?
>
> Geen van beide is zinnig. Als mensen zomaar urls gaan verzinnen zal ik
> ze niet tegenhouden.
Met het 2e schema verzin je geen URLs, de URL is deels zelfdocumenterend.
>>Gok eens waarom domeinnamen gebruikt worden, ipv IP nummers?
>
> Ik neem aan dat je hostnames bedoelt.
domeinnamen, dat staat er. Maar hetzelfde geld voor hostnames.
> Maar goed, ik ken alle voor mij
> belangrijke ip nummers ook wel uit mijn hoofd, heel handig als er weer
> eens iets mis is met dns.
Uiteraard kent elke website bezoeker ook alle belangrijke IP nrs uit
zijn of haar hoofd.
> Maar je ziet nu even over het hoofd dat we het over zoekmachines hebben.
Nee, integendeel, dat zie jij.
> Daar boeit de vorm van hostname niet.
Alweer mis. Ook de vorm van de hostname is belangrijk voor een
zoekmachine. Trefwoorden in hostname cq. domainname, cq. de URI tellen
namelijk *ook* mee. Nog een reden om /fotos/1999/vakanties/srilanka
te verkiezen boven /script?id=12132334
> Gebruiker klopt iets in en hij
> krijgt een lijstje URI met samenvatting. De gebruiker clickt op een URI
> en ziet het resultaat. Voor het resultaat maakt het niet uit vor de
> hostname in numerieke vorm is of als FQDN. Voor het resultaat maakt het
> ook niet uit de request nu /foo?bar=3428364 was of /foo/bar/3428364
> of /fiets/bel/moertje.
Kijk eens naar hoe Google URIs presenteerd?:
http://www.google.com/search?q=srilanka
Account inactive.
Account inactive.
www.embassy.*srilanka*.at/ - 1k - Cached - Similar pages
De cached versie laat zien dat de *ENIGE* plaats waar srilanka
voorkomt... de URI is...
"These terms only appear in links pointing to this page: srilanka"
Tevens is de laatste vorm leesbaarder, b.v. in een posting op Usenet. Ik
weet graag waar een link over gaat, voor ik er op klik. De laatste vorm
zou ik ook nog kunnen onthouden, de 1e 2 zijn wat lastiger.
> Zullen we nu weer even iets uit het begin van de thread oppakken:
> Hoe denkt google dynamische urls te herkennen? Ze gebruiken als argument
> dat ze de website problemen besparen door minder met dynamische urls te
> doen. Als reactie verzinnen ontwikkelaars dus manieren om deze
> eigenaardigheid te omzeilen en dus is alle moeite van google voor neits
> geweest.
En van wie is het dus een keuze? Juist! Van de WEBSITE eigenaar. Snap je
het nu? Je kan dus zelf aangeven of het vervelend is voor je site als
Google als een gek langs komt. De website eigenaar heeft dus bij
dynamisch de keuze: langzaam indexeren, of snel indexeren.
"However, because our web crawler can easily overwhelm and crash sites
serving dynamic content, we limit the amount of dynamic pages we index."
Wie kan het beste dat crashen inschatten?
--
John MexIT: http://johnbokma.com/mexit/
personal page: http://johnbokma.com/
Experienced Perl programmer available: http://castleamber.com/
-
Re: Zoekmachines
John Bokma <postmaster@castleamber.com> wrote:
>> Hoe is voor google de vorm van de url relevant!
>
> De ene vorm ziet Google als dynamisch, de andere als statisch.
>
> "1. Reasons your site may not be included.
>
> * Your pages are dynamically generated. We are able to index
> dynamically generated pages. However, because our web crawler can easily
> overwhelm and crash sites serving dynamic content, we limit the amount
> of dynamic pages we index.
> "
>
> Maar ik vrees dat je het nog steeds niet begrijpt.
Ik wacht nog steeds op het antwoord hoe google dynamische paginas
herkent. Aan de vorm van de url is het niet te zien.
>>>Ja, *zou*. Echter, o.a. Google maakt wel degelijk onderscheid. En hoe
>>>maak jij je websites?
>>
>> Ik maak helemaal geen websites. De laatste is almeer dan 3 jaar geleden.
>
> Dat is meer dan duidelijk.
Kan je geen argumenten meer bedenken en ga je het nu maar op de persoon
spelen?
>>>Op wat *zou* moeten, of de werkelijkheid?
>>
>> Tot de frustratie van de project manager maakt ik dingen zoals ze zouden
>> moeten werken. Ik ga geen bugs van andere fixen.
>
> Bord voor je kop methode, dat werkt uitstekend bij o.a. websites maken.
> Alle browsers hebben bugs.
Dat zal ik niet bestrijden, das ook een van de redenen dat ik me zo min
mogelijk van browsers aantrek.
Maar als iets niet werkt volgens de documentatie dan zit het probleem
dus of in de documentatie of in de implementatie. Als je dan op eigen
initiatief maar gaat hacken rond een probleem dan heb je zelf een
probleem bij de volgende versie van de documentatie of implementatie als
de bug gefixed is, immers je software doet het niet meer.
>>>En wat is zinniger denk je?
>>
>> Geen van beide is zinnig. Als mensen zomaar urls gaan verzinnen zal ik
>> ze niet tegenhouden.
>
> Met het 2e schema verzin je geen URLs, de URL is deels zelfdocumenterend.
Dus /fotos/vakanties/1986/Opper-Volta levert gegarandeerd de gewenste
resultaten op (fotos van dat land uit 1986). Of is het OpperVolta, of
toch maar Burkinafaso?
>>>Gok eens waarom domeinnamen gebruikt worden, ipv IP nummers?
>>
>> Ik neem aan dat je hostnames bedoelt.
>
> domeinnamen, dat staat er. Maar hetzelfde geld voor hostnames.
Een domein naam heeft geen ipnummer, een host wel (er zijn wel hostnames
die toevallig het zelfde zijn als een domeinnaam).
>> Maar goed, ik ken alle voor mij
>> belangrijke ip nummers ook wel uit mijn hoofd, heel handig als er weer
>> eens iets mis is met dns.
>
> Uiteraard kent elke website bezoeker ook alle belangrijke IP nrs uit
> zijn of haar hoofd.
Voor websites is dat nauwelijks interessant, virtualhosts zijn namelijk
afhankelijk van een naam.
>> Maar je ziet nu even over het hoofd dat we het over zoekmachines hebben.
>
> Nee, integendeel, dat zie jij.
Dan vraag ik me toch af waarom het subject al sinds het being
"zoekmachines" is... Ik zou wat later opstaan John, het nog veel te
vroeg voor je, _jij_ bent de persoon die begon over de wat gebruikers
zinniger vinden als url.
>> Daar boeit de vorm van hostname niet.
>
> Alweer mis. Ook de vorm van de hostname is belangrijk voor een
> zoekmachine. Trefwoorden in hostname cq. domainname, cq. de URI tellen
> namelijk *ook* mee. Nog een reden om /fotos/1999/vakanties/srilanka
> te verkiezen boven /script?id=12132334
Niet voor de inhoud, alleen voor wegingsfactoren in rang. Maar dat is
helemaal niet interessant indien je paginas niet worden geindexeerd
omdat google denkt dat ze dynamisch zijn. En dat indexeren was de vraag
van de OP.
> Kijk eens naar hoe Google URIs presenteerd?:
>
> http://www.google.com/search?q=srilanka
>
> Account inactive.
> Account inactive.
> www.embassy.*srilanka*.at/ - 1k - Cached - Similar pages
>
> De cached versie laat zien dat de *ENIGE* plaats waar srilanka
> voorkomt... de URI is...
>
> "These terms only appear in links pointing to this page: srilanka"
>
> Tevens is de laatste vorm leesbaarder, b.v. in een posting op Usenet. Ik
> weet graag waar een link over gaat, voor ik er op klik. De laatste vorm
> zou ik ook nog kunnen onthouden, de 1e 2 zijn wat lastiger.
Ik klik dan ook alleen op links als er een verhaaltje omheen staat,
maar ook dan is er geen garantie dat die url/verhaaltje ook maar iets
met de inhoud te maken heeft.
>> Zullen we nu weer even iets uit het begin van de thread oppakken:
>> Hoe denkt google dynamische urls te herkennen? Ze gebruiken als argument
>> dat ze de website problemen besparen door minder met dynamische urls te
>> doen. Als reactie verzinnen ontwikkelaars dus manieren om deze
>> eigenaardigheid te omzeilen en dus is alle moeite van google voor neits
>> geweest.
>
> En van wie is het dus een keuze? Juist! Van de WEBSITE eigenaar. Snap je
> het nu?
Nee. Als je wilt dat je inhoud gevonden wordt door de monopolist google
heb je geen keuze.
> Je kan dus zelf aangeven of het vervelend is voor je site als
> Google als een gek langs komt.
Voor dat soort geintjes is ooit het /robots.txt fenomeen in het leven
geroepen of al die malle meta tags in de output.
> De website eigenaar heeft dus bij dynamisch de keuze: langzaam
> indexeren, of snel indexeren.
Uit het stukje wat je steeds van google quote kan je lezen dat indien
google denkt dat je dynamische paginas serveert:
> "However, because our web crawler can easily overwhelm and crash sites
> serving dynamic content, we limit the amount of dynamic pages we index."
^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
Limiet op aantal, niet op snelheid.
De keuze is volledig indexeren of gedeeltelijk. MAW als je wilt dat
alles wordt geindexeerd door de searchengine die momenteel een bijna
monopolistisch marktaandeel heeft moet je de criteria achterhalen waarom
google denkt dat iets dynamisch is. En dat is aan de url niet te zien...
En het wordt al helemaal ingewikkeld als je over een tijdje al je urls
op een andere manier moet rewriten of je output moet gaan veranderen om
in de volgende meest gebruikte se te komen.
We zijn weer terug bij af.
--
Daniel Tryba
-
Re: Zoekmachines
Inca <shadow*movements@wanadoo.nospam.invalid> wrote:
>> Ik heb dan ook het gevoel dat je
>> het jezelf erg lastig maakt als je een boel links in nietszeggende
>> files zonder beschrijving opslaat.
>
> Ik sla ze dan ook /zelf/ meestal niet op zonder beschrijving als ik de keuze
> heb. Maar weet je, ik heb niet altijd de keuze. En ik ervaar dat ik vaak
> url's tegenkom waarvan ik geen idee heb wat het is, en dat het dan
> makkelijker is om een 'leesbare' url te hebben. En dus interesseert het mij,
> als gebruiker, wel. En dus klopt jouw stelling dat het de gebruiker niets
> interesseert, niet.
Tijd voor een marktonderzoek naar "de gebruiker" :)
--
Daniel Tryba
-
Re: Zoekmachines
Daniel Tryba wrote:
> John Bokma <postmaster@castleamber.com> wrote:
>
>>>Hoe is voor google de vorm van de url relevant!
>>
>>De ene vorm ziet Google als dynamisch, de andere als statisch.
>>
>>"1. Reasons your site may not be included.
>>
>> * Your pages are dynamically generated. We are able to index
>>dynamically generated pages. However, because our web crawler can easily
>>overwhelm and crash sites serving dynamic content, we limit the amount
>>of dynamic pages we index.
>>"
>>
>>Maar ik vrees dat je het nog steeds niet begrijpt.
>
> Ik wacht nog steeds op het antwoord hoe google dynamische paginas
> herkent. Aan de vorm van de url is het niet te zien.
Google neemt (o.a) aan dat een pagina dynamisch is, als de URL een
bepaalde vorm heeft.
>>>>Op wat *zou* moeten, of de werkelijkheid?
>>>
>>>Tot de frustratie van de project manager maakt ik dingen zoals ze zouden
>>>moeten werken. Ik ga geen bugs van andere fixen.
>>
>>Bord voor je kop methode, dat werkt uitstekend bij o.a. websites maken.
>>Alle browsers hebben bugs.
>
> Dat zal ik niet bestrijden, das ook een van de redenen dat ik me zo min
> mogelijk van browsers aantrek.
>
> Maar als iets niet werkt volgens de documentatie dan zit het probleem
> dus of in de documentatie of in de implementatie. Als je dan op eigen
> initiatief maar gaat hacken rond een probleem dan heb je zelf een
> probleem bij de volgende versie van de documentatie of implementatie als
> de bug gefixed is, immers je software doet het niet meer.
Klopt. En soms is het helaas mogelijk. Je kan of een feature vermijden,
of er om heen hacken en scherp blijven.
>>>>En wat is zinniger denk je?
>>>
>>>Geen van beide is zinnig. Als mensen zomaar urls gaan verzinnen zal ik
>>>ze niet tegenhouden.
>>
>>Met het 2e schema verzin je geen URLs, de URL is deels zelfdocumenterend.
>
> Dus /fotos/vakanties/1986/Opper-Volta levert gegarandeerd de gewenste
> resultaten op (fotos van dat land uit 1986). Of is het OpperVolta, of
> toch maar Burkinafaso?
Een tip, is om in URIs geen uppercase letters te gebruiken, om
verwarringen te voorkomen. Maar je snapt dat een willekeurig id gokken
nog minder kans geeft op resultaten? Als id=399 foto's geeft, wat is de
kans dat id=400 foto's geeft? Echter, de kans dat:
/fotos/
/fotos/1999/
/fotos/1999/vakanties
allemaal een index pagina geven met een overzicht is groot als de
webbouwer verstand van zaken heeft. En in de praktijk werkt dit
inderdaad erg vaak, tenminste ik hack nogal eens URLs :-D.
>>Uiteraard kent elke website bezoeker ook alle belangrijke IP nrs uit
>>zijn of haar hoofd.
>
> Voor websites is dat nauwelijks interessant, virtualhosts zijn namelijk
> afhankelijk van een naam.
Dat hangt helemaal af van de gebruikte techniek. Bij meer dan 1 website
op 1 machine spreekt men van virtual hosting. En je kan meer dan 1 IP
nr, dus 1 per virtual host, op 1 machine gebruiken. Meestal moet je daar
extra voor betalen, overigens.
>>>Maar je ziet nu even over het hoofd dat we het over zoekmachines hebben.
>>
>>Nee, integendeel, dat zie jij.
>
>
> Dan vraag ik me toch af waarom het subject al sinds het being
> "zoekmachines" is... Ik zou wat later opstaan John, het nog veel te
> vroeg voor je, _jij_ bent de persoon die begon over de wat gebruikers
> zinniger vinden als url.
Nee, ik begon over wat zoekmachines als Google zinnig vinden als URL, en
dat je een URL *en* Google vriendelijk kan maken (lees: vaker
indexeren), *en* ook nog eens vriendelijk voor de bezoeker kan maken.
Overigens woon ik in een totaal andere tijdzone :-D.
>>>Daar boeit de vorm van hostname niet.
>>
>>Alweer mis. Ook de vorm van de hostname is belangrijk voor een
>>zoekmachine. Trefwoorden in hostname cq. domainname, cq. de URI tellen
>>namelijk *ook* mee. Nog een reden om /fotos/1999/vakanties/srilanka
>>te verkiezen boven /script?id=12132334
>
> Niet voor de inhoud, alleen voor wegingsfactoren in rang. Maar dat is
> helemaal niet interessant indien je paginas niet worden geindexeerd
> omdat google denkt dat ze dynamisch zijn. En dat indexeren was de vraag
> van de OP.
Dus het boeit allemaal wel.
>>En van wie is het dus een keuze? Juist! Van de WEBSITE eigenaar. Snap je
>>het nu?
>
> Nee. Als je wilt dat je inhoud gevonden wordt door de monopolist google
> heb je geen keuze.
Jawel, alleen het indexeren gaat langzamer. De website eigenaar kan zelf
het beste beoordelen of Google als een gek een dynamisch deel mag
indexeren, of dat dit liever rustig gebeurd.
>>Je kan dus zelf aangeven of het vervelend is voor je site als
>>Google als een gek langs komt.
>
> Voor dat soort geintjes is ooit het /robots.txt fenomeen in het leven
> geroepen of al die malle meta tags in de output.
http://www.robotstxt.org/wc/robots.html
Met een robots.txt bestand kan je alleen aangeven of een bestand cq
directory gespiderd mag worden, en zo ja / nee, door welke bot(s). IIRC
is er geen manier om aan te geven dat een groep documenten met een
interval van x seconden tussen elk document, gespiderd moet worden.
>>De website eigenaar heeft dus bij dynamisch de keuze: langzaam
>>indexeren, of snel indexeren.
>
> Uit het stukje wat je steeds van google quote kan je lezen dat indien
> google denkt dat je dynamische paginas serveert:
>
>
>>"However, because our web crawler can easily overwhelm and crash sites
>>serving dynamic content, we limit the amount of dynamic pages we index."
>
> ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
>
> Limiet op aantal, niet op snelheid.
Fout! Er staat duidelijk *our web crawler can easily overwhelm and crash
sites*. Hoe kan dat? Door het in hoog tempo ophalen van een flink aantal
pagina's *per bezoek*. En daarom: "we limit the amount of dynamic pages
we index" PER BEZOEK.
Hoe kan een webcrawler een site laten crashen als het 1x per dag 1
dynamische link ophaalt.... Juist, niet dus.
> De keuze is volledig indexeren of gedeeltelijk.
Nop, zie boven.
> MAW als je wilt dat
> alles wordt geindexeerd door de searchengine die momenteel een bijna
> monopolistisch marktaandeel heeft moet je de criteria achterhalen waarom
> google denkt dat iets dynamisch is. En dat is aan de url niet te zien...
Of het werkelijk dynamisch is, is inderdaad niet aan de vorm te zien.
Sterker, als het dynamisch is, zijn er massa's truuks om het altijd
statisch te presenteren, en omgekeerd. Dus hanteerd Google een ander
criteria.
> En het wordt al helemaal ingewikkeld als je over een tijdje al je urls
> op een andere manier moet rewriten of je output moet gaan veranderen om
> in de volgende meest gebruikte se te komen.
Ja, en stel je voor dat die zoekmachine alle URLs met id= er in gaat
uitsluiten. Ben je ook mooi zuur.
--
John MexIT: http://johnbokma.com/mexit/
personal page: http://johnbokma.com/
Experienced Perl programmer available: http://castleamber.com/
-
Re: Zoekmachines
John Bokma wrote:
[ dingen die niet werken zoals gedocumenteerd ]
> Klopt. En soms is het helaas mogelijk. Je kan of een feature vermijden,
> of er om heen hacken en scherp blijven.
Dat moet onmogelijk zijn, natuurlijk :-D.
--
John MexIT: http://johnbokma.com/mexit/
personal page: http://johnbokma.com/
Experienced Perl programmer available: http://castleamber.com/
-
Re: Zoekmachines
Daniel Tryba:
>Ik wacht nog steeds op het antwoord hoe google dynamische paginas
>herkent. A
Dat hebben we alleen al in deze thread inmiddels 3 keer uitgelegd. Dit
begint een beetje saai te worden.
--
René Pijlman
Wat wil jij leren? http://www.leren.nl
-
Re: Zoekmachines
Rene Pijlman <reply.in.the.newsgroup@my.address.is.invalid>:
> Daniel Tryba:
>
>>Ik wacht nog steeds op het antwoord hoe google dynamische paginas
>>herkent. A
>
> Dat hebben we alleen al in deze thread inmiddels 3 keer uitgelegd. Dit
> begint een beetje saai te worden.
"Google herkent bepaalde patronen in URLs. ?id= enzo."
Statische HTML pagina's kan je net zo goed dergelijke 'patronen' meegeven
(voor het clientside parsen van die dingen bijvoorbeeld), en dynamische
HTML pagina's gebruiken niet per definitie zulke 'patronen'.
--
robert