
Web scraping op Okou
Geef een agent een link en hij komt terug met wat de pagina daadwerkelijk zegt, in schone, leesbare tekst. Geen scraping-leverancier om je bij aan te melden.
Webgegevens · Geen setup · Twee factureringsmodi, standaard en uitgebreid
Wijs een agent naar een openbare link en deze leest de pagina voor je: de woorden, niet de navigatiemenu's, cookiebanners en voetteksten. Vraag om de pagina als schone tekst, of alleen om de lijst met links erop wanneer de taak is om te beslissen wat je vervolgens gaat lezen.
Het lezen gebeurt op Firecrawl, en het is er zodra je erom vraagt: geen installatie, geen sleutel, niets voor je team om te onderhouden. Het blijft bewust smal: één pagina per verzoek. Pagina's vinden is de taak van webzoekmachines, en alles achter een aanmelding of een klik behoort tot de externe browser.
Wat Webscraping is
Elke onderzoekstaak bereikt het punt waarop een zoekresultaat niet voldoende is en u nodig hebt wat de pagina daadwerkelijk zegt. Dat goed doen is moeilijker dan het lijkt. Pagina's laden de helft van hun inhoud met scripts, en de nuttige tekst bevindt zich tussen menu's, banners en advertenties.
Op Okou is dat deel al voor u opgelost. De agent stuurt één openbare link en krijgt de pagina terug als schone tekst die hij kan lezen en samenvatten, of als een lijst van elke link erop.
Sommige pagina's weerstaan een normale lezing. Daarvoor is er een sterkere modus, en de agent moet erom vragen, omdat het meer kost per pagina en je moet kunnen zien wanneer een workflow ervoor heeft gekozen.
Het is hetzelfde waar mensen naar zoeken als een web scraping API. Het verschil is dat u niet hoeft te zoeken: het zit al in de run, dus u vraagt om de pagina in een bericht en de agent brengt terug wat erop staat.
Wat Webscraping kan doen
Wat een agent ermee kan doen, en wat er terugkomt als het dat doet.
Dekking en limieten
Wat het niet doet, vooraf gezegd, zodat niemand een workflow plant rond iets dat buiten het bereik valt.
Alleen openbare pagina's
Er is geen aanmelding vereist, dus een pagina achter een login, een betaalmuur of een botmuur valt buiten het bereik. Daarvoor is de externe browser bedoeld.
Eén pagina tegelijk
Het leest de pagina waarnaar je verwijst. Het dwaalt niet door de rest van de site, dus het lezen van een hele site betekent pagina voor pagina vragen en pagina voor pagina betalen.
De dure modus is een keuze
De meeste pagina's lezen prima op de normale manier. De sterkere modus kost meer en een agent moet erom vragen, dus een workflow wordt nooit stilletjes duurder.
Wat terugkomt is informatie, geen orders
Tekst van een webpagina wordt behandeld als iets om te lezen, nooit als instructies om te volgen. Dat is wat voorkomt dat een vijandige pagina een agent overhaalt om iets anders te doen.
Wat Webscraping kost
Webservices worden per aanroep in credits afgerekend, niet per token. Je hoeft geen aparte leveranciersfactuur te controleren.
zero scrapeHet lezen van een pagina verbruikt credits, en de sterkere modus kost meer dan de normale. Er is niets anders te kopen en geen minimum, dus een workflow die drie pagina's per week leest, betaalt alleen voor het werk dat het doet.
Productnamen en logo's behoren toe aan hun eigenaren en verschijnen hier alleen om aan te geven op welke service een dienst draait. Ze impliceren geen goedkeuring of partnerschap.
Instellen en toegang
Niets in te stellen
Niets om te verbinden. Geen aanmelding, geen sleutel om te plakken, niets toegevoegd aan je connectorlijst. Dat is het verschil tussen dit en de Firecrawl-connector in de catalogus van Okou: de connector werkt met je eigen Firecrawl-account als je er al een hebt, en dit is er gewoon voor elke agent om te gebruiken.
Wie het kan gebruiken
Webpagina's lezen is een toestemming die u geeft, niet iets wat elke agent heeft. Geef het aan de agents en de mensen die het nodig hebben, zolang ze het nodig hebben, en neem het terug zonder iets anders aan te raken wat die agent kan doen.
Waarvoor teams Webscraping gebruiken
De pagina achter een zoekresultaat lezen
Zoeken geeft je een kop en twee regels. Het meeste werk heeft de hoofdtekst nodig, dus het patroon is eerst zoeken, de twee of drie relevante resultaten kiezen en dan alleen die lezen.
Pagina's bekijken die geen andere toegang hebben
Prijzen van concurrenten, changelogs, statuspagina's, wettelijke mededelingen. Een geplande agent leest de pagina, vergelijkt deze met vorige week en vertelt je alleen wanneer er iets is veranderd.
Een lang document omzetten in werkmateriaal
Een specificatie, een jaarverslag, een helpcentrum. Schone tekst is het verschil tussen een samenvatting van het document en een samenvatting van het navigatiemenu.
Wanneer Webscraping niet te gebruiken
Sla het over wanneer de pagina een aanmelding, een klik of een formulier nodig heeft, en gebruik in plaats daarvan de externe browser. Sla het over voor het lezen van een hele site, waar de kosten per pagina sneller oplopen dan het antwoord waard is. En sla het over wanneer de bron zelf de juiste gegevens publiceert, wat bijna altijd stabieler is dan het lezen van de pagina's.
Hoe dit elders wordt genoemd
Hetzelfde ding heeft verschillende namen op de markt. Als je er een hebt gekocht, is dit hoe het overeenkomt met wat je hier krijgt.
Web scraping API
De gebruikelijke naam voor het betalen van een dienst om een pagina op te halen en de tekst ervan terug te geven. Dat is precies wat dit is. Het account en de sleutel behoren toe aan Okou in plaats van aan u.
Scrapen zonder een scraper te schrijven
Niets te bouwen en niets te onderhouden. Je vraagt om de pagina in een bericht, en het ophalen en opschonen gebeuren binnen de run.
HTML naar Markdown
De conversie die mensen normaal zelf schrijven: een pagina HTML erin, schone Markdown eruit. Het gebeurt voordat de tekst de agent bereikt, daarom besteedt een model zijn aandacht aan de inhoud in plaats van aan de opmaak.
AI of LLM web scraping
Scrapen waarvan de uitvoer bedoeld is om door een model te worden gelezen in plaats van door code te worden geparseerd. Het is dezelfde fetch, beoordeeld op of de tekst leesbaar is in plaats van op of een selector nog steeds overeenkomt.
No-code web scraping
Niemand schrijft hier een scraper. Je vraagt om de pagina in een bericht en de agent doet het ophalen, wat mensen zoeken als ze zoeken naar scraping zonder code.
Webscraping vergeleken
Webscraping vs uw eigen scraper bouwen
Dezelfde output, een heel andere hoeveelheid werk. Op eigen houtje is het een service om te kiezen of een fetcher om te schrijven, een sleutel die iemand veilig moet bewaren, en onderhoud elke keer dat een pagina van vorm verandert. Hier vraag je en lees je het antwoord, en toegang is een toestemming in plaats van een gedeeld geheim.
Webscraping vs de Firecrawl connector
Okou levert ook een Firecrawl-connector, en dat is de juiste keuze als je al een Firecrawl-account hebt en het gebruik daar wilt, of iets nodig hebt dat deze service niet dekt. De ingebouwde is juist wanneer je liever gewoon vraagt en de pagina krijgt.
Webscraping vs zelf een browser besturen
Een browser die u bedient is capabeler en veel meer werk, en u moet de pagina daarna nog steeds omzetten in leesbare tekst. Gebruik de externe browser wanneer de taak echt klikken vereist, en deze wanneer u alleen nodig hebt wat de pagina zegt.
De korte versie
De standaard manier om een webpagina te lezen op Okou. Als de pagina openbaar is en u wilt wat erop staat, is dit één stap, geen account, en een vergoeding per pagina. Alles wat moet inloggen of klikken behoort tot de externe browser.
Veelgestelde vragen
Heb ik een Firecrawl-account nodig?
Nee. Een pagina lezen is iets wat elke agent al kan, dus je hoeft het alleen maar te vragen. Er is geen account aan te maken en geen sleutel te bewaren.
Hoe verschilt dit van de Firecrawl-connector?
De connector werkt met je eigen Firecrawl-account als je er al een hebt en het gebruik daar wilt. De ingebouwde service is klaar voor gebruik zonder configuratie.
Kan het pagina's achter een login lezen?
Nee. Het opent openbare pagina's zonder aanmelding. Gebruik de externe browser, die ingelogd kan blijven en halverwege door een persoon kan worden overgenomen.
Kan het een hele website lezen?
Niet vanzelf. Elke leesactie is één pagina, dus een site behandelen betekent pagina voor pagina vragen, en elke pagina wordt in rekening gebracht. Het is de moeite waard om een limiet in te stellen.
Wat kost het lezen van een pagina?
Credits per succesvolle leesactie, met een hogere vergoeding voor de sterkere modus die wordt gebruikt op pagina's die een normale leesactie weerstaan. Die modus wordt nooit stilzwijgend gekozen.
Is het veilig om te handelen naar wat terugkomt?
Behandel het als informatie. Okou verwerkt tekst van een webpagina als materiaal om te lezen in plaats van instructies om te volgen, wat voorkomt dat een pagina de agent die het heeft gelezen omleidt.
Heb ik nog steeds een scrapingtool nodig?
Voor schone tekst van een pagina binnen een workflow, nee: je kunt een agent vragen en het krijgen. Als je het eigen dashboard en de volledige functionaliteit van een scraping-leverancier wilt, verbind dan in plaats daarvan je eigen account via de connector.
Hoe verhouden de kosten zich tot een eigen scrapingplan?
Scraping tools verkopen meestal maandelijkse abonnementen met een minimum. Hier verbruikt het lezen van een pagina credits zonder maandelijkse verplichting, wat past bij een workflow die een handvol pagina's per week leest en de moeite waard is om op zeer hoog volume te meten.
Kan het Markdown retourneren voor een model om te lezen?
Ja. Schone Markdown is de standaardvorm, wat een pagina bruikbaar maakt als context in plaats van als een muur van opmaak.
Moet ik een scraper schrijven of selectors onderhouden?
Nee. Er is niets te schrijven en niets dat kapot gaat wanneer een pagina opnieuw wordt ontworpen, omdat u vraagt om de tekst van de pagina in plaats van om de inhoud van een specifiek element.
Hoe je om Webscraping vraagt
Je beschrijft in gewone taal wat je wilt. De agent bepaalt welke service nodig is en roept die aan.
“Lees deze pagina en geef me de vijf dingen die ertoe doen, met de exacte bewoording voor elk.”
“Haal de links van deze documentatie-index, lees dan de drie over prijzen en vergelijk ze.”
“Controleer elke maandag de prijspagina van onze concurrent en vertel me alleen als er iets is veranderd.”

