PapersGPT-prestatiebenchmark: indexeer 1,500+ PDF's in minuten, haal resultaten op in milliseconden
Elke onderzoeker is tegen dezelfde muur opgelopen: uw Zotero-bibliotheek groeit uit tot honderden — of duizenden — PDF's, en plotseling wordt "de paper vinden die X zei" een ware speurtocht. Cloud-AI-tools dwingen u om alles naar de servers van iemand anders te uploaden. Desktopapps kruipen vooruit. En wanneer u een AI een vraag stelt, wacht u seconden terwijl deze door uw bibliotheek ploegt.
PapersGPT is gebouwd om dat wachten te laten verdwijnen. We hebben een reeks gecontroleerde benchmarks uitgevoerd op echte hardware om dat te bewijzen. Hier zijn de cijfers.
De benchmarkopstelling
We hebben drie zaken gemeten die het meest belangrijk zijn voor dagelijks onderzoekswerk:
- Indexeertijd — hoe lang het duurt om uw PDF-bibliotheek te scannen en te indexeren voor zoeken.
- Geheugenvoetafdruk — hoeveel RAM het achtergrondagentproces verbruikt, zowel in rust als tijdens het zoeken.
- Ophaallatentie — hoe snel een query onderbouwde resultaten uit uw bibliotheek teruggeeft.
De tests zijn uitgevoerd in echte Zotero-installaties op twee machines: een Mac met een Intel i9-processor en een Windows virtuele machine (4 cores / 8 GB RAM) die op dezelfde Intel i9 Mac draait — een bewust bescheiden opstelling die een typische kantoor-pc nabootst.
De resultaten: PapersGPT-prestatiebenchmark
| Metriek | Mac (Intel i9) | Windows VM (4C8G) |
|---|---|---|
| Bibliotheekgrootte | 1,506 PDF's (4.5 GB op schijf) | 500+ PDF's |
| Indexeertijd | 141 seconden | Enkele seconden |
| Geheugen (agentproces) | 227 MB | 160 MB |
| Gemiddelde ophaaltijd | ~15 ms | ~15 ms |
De Windows-VM deelt dezelfde Intel i9 Mac als host, met slechts 4 cores en 8 GB RAM die eraan zijn toegewezen.
Laten we bekijken wat die cijfers nu echt betekenen.
1. Meer dan 1,500 PDF's indexeren in minder dan 2.5 minuten
Op de Mac indexeerde PapersGPT 1,506 PDF's met 4.5 GB aan schijfruimte in slechts 141 seconden. Dat is ruwweg 10 papers per seconde — geen nacht wachten, geen "uw bibliotheek wordt geïndexeerd"-voortgangsbalk van een uur. U installeert de plugin, deze scant uw bibliotheek en u kunt chatten voordat uw koffie koud wordt.
Op de Windows-VM — slechts 4 cores en 8 GB RAM — duurde het indexeren van 500+ PDF's slechts enkele seconden, zodat zelfs een groeiende bibliotheek vrijwel op aanvraag wordt geïndexeerd.
Ter vergelijking: veel cloudgebaseerde "chat met uw documenten"-tools vereisen dat u bestanden één voor één uploadt en ze vervolgens server-side verwerkt, wat op een trage dag minuten per document kan duren. De lokale indexering van PapersGPT is feitelijk onmiddellijk.
2. Een geheugenvoetafdruk die uw machine niet vertraagt
Onderzoekstools die 1-2 GB RAM opslokken zijn heel gewoon. Het agentproces van PapersGPT blijft licht: 227 MB op de Intel i9 Mac en slechts 160 MB op de 4C8G Windows-VM, terwijl het een bibliotheek van 1,500+ documenten verwerkt.
Dat is belangrijk wanneer Zotero, uw browser, een PDF-reader en een LaTeX-editor allemaal strijden om dezelfde 16 GB RAM. Een lichtgewicht achtergrondagent betekent dat u nooit hoeft te kiezen tussen uw referentiebeheerder en uw andere apps.
3. ~15 ms ophaaltijd: sneller dan u de vraag kunt bedenken
Het belangrijkste cijfer is de ophaallatentie. PapersGPT geeft resultaten met bronverwijzingen uit uw bibliotheek terug in gemiddeld ongeveer 15 milliseconden. Ter context:
- Een typische webpagina laadt in 1,000–3,000 ms.
- Een knipper met de ogen duurt ongeveer 100–150 ms.
- PapersGPT antwoordt in 15 ms — een orde van grootte sneller dan een knipper met de ogen.
Dit is wat "chatten met uw onderzoeksbibliotheek" native laat aanvoelen in plaats van als een externe API-aanroep. U stelt een vraag over uw papers en het antwoord is feitelijk onmiddellijk, met citaten die naar de exacte PDF's verwijzen.
Waarom is PapersGPT zo snel?
De prestaties van PapersGPT zijn geen toeval — ze komen voort uit technische keuzes die zijn ontworpen voor local-first snelheid:
Een native C++-kern
De indexerings- en ophaalmotor is geschreven in C++, dezelfde taalfamilie die wordt gebruikt voor database-engines en handelssystemen. Dat elimineert de overhead van geïnterpreteerde runtimes (Python, Node) in het kritieke pad van het zoeken.
BM25 full-text zoeken
PapersGPT combineert BM25 full-text zoeken in titels, auteurs, tags, samenvattingen en uw persoonlijke annotaties met onmiddellijke full-text ophaling op basis van primaire sleutels. BM25 is hetzelfde rankingmodel dat achter moderne zoekmachines zit — bewezen, snel en zeer relevant voor academische teksten.
Nul netwerkroundtrips
Omdat alles lokaal draait, is er geen uploadwachtrij, geen server-side indexeringstaak en geen netwerklatentie tussen uw vraag en uw papers. De snelheid die u ziet, is de snelheid van uw eigen machine.
Lichtgewicht agentontwerp
De achtergrondagent is bewust minimaal — hij laadt alleen een volledige LLM in het geheugen wanneer u een samenvatting of een chatantwoord genereert. Zoeken, de meest voorkomende bewerking, blijft goedkoop.
Wat dit betekent voor uw onderzoeksworkflow
Grote bibliotheken zijn geen probleem meer
Op het moment dat uw Zotero-bibliotheek de 1,000 papers passeert, beginnen de meeste AI-onderzoekstools te haperen — uploads duren eeuwig, zoekopdrachten vertragen en het geheugengebruik zwelt op. PapersGPT is het tegenovergestelde. Gebouwd op een native C++-engine die is ontworpen voor schaalbaarheid, verwerkt hij bibliotheken van 1,000 papers, 5,000 papers of zelfs 10,000+ papers volledig moeiteloos.
Dit is het belangrijkste inzicht uit de benchmark: de indexeringskosten groeien ruwweg lineair met de omvang van de bibliotheek, terwijl de ophaaltijd in essentie constant blijft. Het indexeren van 1,506 PDF's duurde 141 seconden — dus een bibliotheek van 10,000 papers (ongeveer 30 GB) zou in ruwweg 15–20 minuten worden geïndexeerd, en die kosten betaalt u slechts eenmaal per nieuw paper. Dagelijks zoeken blijft ~15 ms, of u nu 100 papers of 10,000 bezit. Het geheugen blijft laag in de honderden MB's, ongeacht de omvang van de bibliotheek, omdat de agent op aanvraag indexeert en zoekt in plaats van uw hele bibliotheek in het RAM te laden.
Kortom: de omvang van de bibliotheek is geen reden meer om AI te vermijden. Of u nu een PhD-student bent met een paar honderd papers of een doorgewinterde onderzoeker met tienduizenden papers, PapersGPT voelt hetzelfde aan — direct, lichtgewicht en moeiteloos.
Ook oudere hardware voelt snel aan
U hebt geen workstation of GPU nodig om goede zoekprestaties te krijgen. De benchmark draaide op een consumenten-Intel i9 Mac — en de Windows-test was een nog zwaarder geval: een virtuele machine met 4 cores en 8 GB die dezelfde Mac deelt. Zelfs daar indexeerde PapersGPT 500+ PDF's in seconden met een voetafdruk van 160 MB. Als PapersGPT zo responsief aanvoelt in een bescheiden VM, voelt het moeiteloos aan op elke echte machine waarmee u daadwerkelijk werkt.
Uw gegevens blijven lokaal
Snelheid is niet de enige reden om lokaal te zoeken — privacy ook. PapersGPT indexeert en doorzoekt uw PDF's op uw eigen machine, zodat gevoelig, ongepubliceerd of bedrijfseigen onderzoek nooit uw computer verlaat. (Als u uw bibliotheek wilt verbinden met externe AI-assistenten, biedt de Zotero MCP-server u die optie op uw eigen voorwaarden.)
PapersGPT versus cloud-onderzoekstools
Cloudtools zoals NotebookLM en ChatPDF lossen het probleem "zoek mijn papers" op door uw bibliotheek naar de cloud te uploaden — wat u tijd kost (upload + server-side verwerking) en privacy (uw gegevens op de servers van iemand anders).
| Cloud-AI-tools | PapersGPT | |
|---|---|---|
| Installatie | PDF's handmatig uploaden | Indexeert uw bestaande Zotero-bibliotheek |
| 1,500 PDF's indexeren | Minuten per upload, server-side wachtrij | 141 seconden, lokaal |
| Zoeklatentie | 500–2,000 ms (netwerk) | ~15 ms (lokaal) |
| Geheugenimpact | Browsertabblad + cloud | 160–227 MB agent |
| Privacy | Gegevens verlaten uw machine | Blijven op uw machine |
Voor een diepere vergelijking leest u onze gids NotebookLM vs. ChatPDF vs. PapersGPT.
Veelgestelde vragen
Hoe indexeer ik mijn Zotero-bibliotheek met PapersGPT?
Installeer de PapersGPT-plugin, open Zotero en selecteer de papers waarmee u wilt werken. PapersGPT indexeert ze automatisch — geen handmatige upload, geen aparte app. Een bibliotheek van 1,500 PDF's wordt in ongeveer twee minuten geïndexeerd.
Heeft PapersGPT een internetverbinding nodig om te zoeken?
Nee. Indexering en ophaling verlopen volledig lokaal, en daarom worden ze in milliseconden gemeten. U kunt offline in uw bibliotheek zoeken; cloud-AI-modellen worden alleen gebruikt wanneer u ze expliciet kiest voor het genereren van antwoorden.
Zal PapersGPT mijn computer vertragen?
Nee — de achtergrondagent gebruikt slechts 160–227 MB geheugen. Hij blijft uit de weg terwijl Zotero, uw browser en uw editor normaal draaien.
Kan PapersGPT bibliotheken groter dan 1,500 PDF's aan?
Absoluut — dit is waar PapersGPT uitblinkt. De benchmark gebruikte 1,506 PDF's als realistische test, maar de engine schaalt ver daarboven. Of uw Zotero-bibliotheek nu 1,000, 5,000 of 10,000+ papers bevat, PapersGPT gaat er volledig moeiteloos mee om: indexering groeit ruwweg lineair (een bibliotheek van 10,000 papers wordt in enkele minuten geïndexeerd), de ophaaltijd blijft ~15 ms en het geheugen blijft laag in de honderden MB's. Er is geen praktische bibliotheekomvang waarbij PapersGPT traag begint aan te voelen.
Conclusie
De benchmark is duidelijk: PapersGPT indexeert een bibliotheek van 1,506 PDF's en 4.5 GB in 141 seconden, verbruikt slechts 227 MB geheugen op een Intel i9 Mac (160 MB in een 4C8G Windows-VM) en haalt antwoorden op in ~15 ms. En omdat de engine lineair schaalt voor indexering en de ophaaltijd constant houdt, blijft die moeiteloze snelheid behouden of uw Zotero-bibliotheek nu 1,000 papers of 10,000+ papers bevat. Die combinatie — snelle indexering, kleine voetafdruk, onmiddellijke ophaling en volledig lokale privacy — zorgt ervoor dat PapersGPT minder als een plugin aanvoelt en meer als een native onderdeel van uw onderzoeksworkflow.
Klaar om het verschil te voelen? Probeer PapersGPT met uw Zotero-bibliotheek en ontdek hoe snel onderzoek kan zijn.