Ein Zitatssymbol ist noch kein Beleg
Eine KI-Antwort kann sauber gegliedert sein, zehn Quellen nennen und trotzdem an der entscheidenden Stelle vorbeizitieren. Drei Fragen gehören deshalb auseinander: Ist überhaupt eine Quelle angegeben? Stützt sie die Aussage direkt? Und ist diese Quelle für die jeweilige Forschungsfrage belastbar?
Eine Untersuchung generativer Suchsysteme aus dem Jahr 2023 hat genau diese Unterschiede sichtbar gemacht. Sie bewertet historische Produktversionen und taugt nicht als Rangliste für 2026. Als methodische Warnung bleibt sie nützlich: Mehr Zitate bedeuten nicht automatisch bessere Evidenz. Wer sich über weitere Werkzeuge informieren möchte, findet sie in der deutschen Kategorie KI-Produktivität. Für die Auswahl zählt jedoch zuerst der Quellenrahmen.
- Für eine rasche Orientierung im offenen Web: Perplexity
- Für eine umfangreiche Untersuchung mit gemischten Quellen: ChatGPT Deep Research
- Für Fragen an einen freigegebenen Dokumentbestand: Gemini Notebook (NotebookLM)
- Für wissenschaftliche Kurzfragen mit Belegspur: Consensus
- Für Screening und strukturierte Datenextraktion: Elicit
- Für Suche, Lektüre und Ordnung in einem Arbeitsbereich: SciSpace
- Für den Kontext späterer Zitate: Scite
- Für die visuelle Erweiterung eines Literaturbestands: ResearchRabbit
Was „am besten“ bei Recherche tatsächlich bedeutet
Ein allgemeiner Sieger wäre bequem, aber sachlich schwach. Eine Websuche zu einer neuen Regulierung, die Analyse von 40 internen Interviews und die Suche nach klinischen Studien stellen völlig andere Anforderungen. Wir ordnen die acht Werkzeuge deshalb nach ihrem besten Einsatzgebiet, nicht nach einem vermeintlich universellen Genauigkeitswert.
In die Auswahl kamen aktive Produkte, bei denen offizielle Seiten einen klaren Umgang mit Quellen, Zitaten oder Evidenz bestätigen. Bewertet wurden der Quellenrahmen, die Granularität der Belegspur, die Rolle im Ablauf von Suche bis Prüfung, Exportmöglichkeiten, ein sinnvoller kostenloser Einstieg, der Preis und die wichtigste Einschränkung. Alle Tarif- und Kontingentangaben wurden am 30. September 2026 geprüft. Dynamische Limits, regionale Unterschiede und zeitlich begrenzte Rabatte können sie später verändern.
| Ausgangslage | Geeigneter Werkzeugtyp | Was Sie vor dem Übernehmen prüfen sollten |
|---|---|---|
| Das Thema ist neu, aktuell und über viele Websites verteilt | Websuche oder mehrstufige Webrecherche | Autor, Datum, Primärquelle und Aussagekontext |
| Die Antwort darf nur auf genehmigten Dateien beruhen | Recherche in einem festgelegten Quellenbestand | Vollständigkeit und Aktualität der hochgeladenen Sammlung |
| Sie müssen viele Paper sichten und Merkmale vergleichen | Akademische Suche mit Screening und Extraktion | Ein- und Ausschlusskriterien, Sprachabdeckung und Export |
| Eine zentrale Studie soll auf Widerspruch geprüft werden | Zitationskontext | Bedeutung der Klassifikation und Qualität der zitierenden Arbeit |
| Sie wollen ein Forschungsfeld von wenigen Schlüsselarbeiten aus erschließen | Zitationsgraph | Auswahl der Startpublikationen und dokumentierte Suchwege |
Diese Kriterien erklären auch, warum hier kein einheitlicher Praxistest mit Punktzahlen steht: Dafür wären ein kontrollierter Fragenkatalog, verbindliche Goldstandards und vergleichbare Quellenräume nötig. Eine solche Prüfung wurde für diese Übersicht nicht durchgeführt.
Offenes Web: Schnelle Orientierung oder ausgearbeiteter Bericht
Perplexity hält die erste Suchrunde kurz
Perplexity eignet sich, wenn Sie ein unbekanntes Thema abstecken, aktuelle Quellen finden und über Anschlussfragen enger führen möchten. Der Nutzen liegt in der kurzen Schleife aus Frage, Antwort und verlinkten Fundstellen. Bei Märkten, Politik oder aktuellen Ereignissen ist das oft der schnellste Weg zu einer brauchbaren Quellenliste.
Der kostenlose Standardtarif bot am Stichtag nahezu unbegrenzte einfache Suchen, täglich drei Pro Searches und monatlich eine Research-Anfrage. Diese Kontingente können sich ändern. Pro erhöht unter anderem die Limits für mehrstufige Suche, Recherche, Modelle und Datei-Uploads; eine stabile aktuelle Einzelpreisangabe ließ sich aus den geprüften offiziellen Seiten jedoch nicht ableiten.
Die Grenze zeigt sich bei der Quellenqualität. Eine Antwort kann auf einen schwachen Sekundärtext verweisen, obwohl ein Originaldokument verfügbar wäre. Öffnen Sie daher jeden Beleg, der eine zentrale Zahl, ein Datum oder eine strittige Behauptung trägt.
ChatGPT Deep Research übernimmt die längere Untersuchung
ChatGPT Deep Research passt besser, wenn aus Websites, Berichten, hochgeladenen Dateien und Notizen ein strukturierter Bericht entstehen soll. OpenAI beschreibt die Websuche als aktuellen Abruf mit Quellen und Deep Research als mehrstufige Untersuchung mit überprüfbarem Ergebnis. Besonders sinnvoll wird das Werkzeug, wenn Auftrag, Zeitraum, erlaubte Quellen und Ausgabeformat schon im Prompt feststehen.
Die Flexibilität erhöht allerdings den Prüfaufwand. Ein umfangreicher Bericht kann mehrere Interpretationsschritte enthalten, die von den Quellen getrennt bewertet werden müssen. OpenAI empfiehlt selbst, Aussagen wieder an den Originalquellen zu prüfen und keine Belege zu erfinden oder stärker auszulegen, als es das Material erlaubt. Der genaue Zugang, Preis und Umfang hängen vom Konto beziehungsweise Workspace-Tarif ab; die geprüften Learn-Seiten boten dafür keine belastbare allgemeine Zahl.
Die Entscheidung zwischen beiden Werkzeugen ist damit nüchtern: Für die erste Karte eines Themas spricht Perplexity. Wenn aus einer klar abgegrenzten Frage ein längeres, gegliedertes Arbeitsergebnis werden soll, ist Deep Research die passendere Ausgangsbasis.
Ein eigener Quellenbestand braucht eine harte Grenze
Gemini Notebook, weiterhin vielen unter dem Namen NotebookLM bekannt, arbeitet mit den Quellen, die Sie auswählen. Es verarbeitet unter anderem PDFs, Webseiten, YouTube-Inhalte, Audiodateien, Google Docs und Slides. Im Chat lassen sich einzelne Quellen ein- oder ausschließen; Inline-Zitate führen zur Fundstelle und ihrem Kontext zurück.
Damit eignet sich das Produkt für Kundeninterviews, Kursmaterialien, Projektdokumentationen oder eine bereits kuratierte Sammlung von Fachartikeln. Die feste Grenze verhindert zwar einen Teil des offenen Webrauschens, löst aber kein Vollständigkeitsproblem. Fehlt eine Gegenposition in den hochgeladenen Unterlagen, kann das System sie nicht ergänzen. Veraltete oder einseitige Dokumente bleiben veraltet oder einseitig.
Seit dem 2. September 2026 verwendet Google rechenaufwandsbasierte Limits. Prompt-Komplexität, Funktion und bisheriger Verlauf fließen in den Verbrauch ein; die Anzeige im Produkt ist deshalb verlässlicher als ältere statische Angaben zu Notebooks, Quellen oder Chats. Experimentelle agentische Funktionen benötigen laut Google weiterhin Aufsicht und Nachkontrolle.
Wissenschaftliche Literatur: Frage, Tabelle oder Lesearbeitsplatz
Consensus beantwortet zuerst die wissenschaftliche Frage
Consensus richtet sich an Personen, die eine natürliche Frage stellen und zügig sehen möchten, welche Paper dazu auffindbar sind. Der Research Agent führt mehrstufige semantische Suchen, DOI- und Publikationssuchen sowie Schritte im Zitationsgraphen aus und zeigt seinen Ablauf. „Citation Grounding“ ordnet Zusammenfassungen konkreten Textstellen und Abschnitten zu und verlinkt, sofern verfügbar, das PDF.
Der Anbieter nennt einen Bestand von mehr als 400 Millionen wissenschaftlichen Quellen. Das ist eine Größenangabe des Herstellers, kein Nachweis vollständiger Abdeckung. Kostenlos waren unbegrenzte Paper-Suchen, zehn Pro Messages, drei Deep Reviews, zehn Study Snapshots sowie 30 API-/MCP-Aufrufe pro Monat verfügbar. Pro kostete 20 US-Dollar monatlich oder 144 US-Dollar jährlich, Deep 65 US-Dollar monatlich oder 540 US-Dollar jährlich.
Consensus ist damit stark für die Frage „Was sagt die Forschung ungefähr?“. Eine methodisch vollständige Übersichtsarbeit liefert die schnelle Synthese nicht.
Elicit macht aus Auswahlkriterien eine Datentabelle
Elicit setzt später im Prozess an. Sie formulieren Ein- und Ausschlusskriterien, sichten größere Treffermengen und legen eigene Extraktionsspalten fest. So entsteht aus vielen Publikationen eine nachvollziehbare Tabelle, statt nur einer flüssigen Antwort. Reports lassen sich als PDF oder Word exportieren, Tabellen als CSV oder Excel und Literaturangaben als RIS oder BIB; einzelne Tabellenexporte erfordern einen höheren Tarif.
Basic bot einen begrenzten Zugang zu Research Agent und Reports sowie Paper-Suche, Zusammenfassungen, Paper Chat, Quellenansicht und Zotero-Import. Für den akademischen Bereich lag Plus bei 11 US-Dollar pro Person und Monat bei jährlicher Abrechnung. Der separat ausgewiesene Branchen-Tarif Pro kostete 49 US-Dollar pro Person und Monat, ebenfalls jährlich abgerechnet. Diese beiden Preise gehören zu unterschiedlichen Zielgruppen und sollten nicht zu einem vermeintlichen Standardtarif vermischt werden.
Die wichtigste Einschränkung betrifft die Sprache: Elicit ist laut eigener Dokumentation auf Englisch optimiert. Nicht englische Suche und Analyse können uneinheitlicher ausfallen und mehr Kontingent verbrauchen. Für mehrsprachige Reviews muss dieser Nachteil in der Suchstrategie berücksichtigt werden.
SciSpace bündelt Suche und Lektüre
SciSpace ist die breitere Arbeitsoberfläche. Literature Review verbindet Papersuche, Gespräche mit einzelnen Arbeiten, benutzerdefinierte Extraktionsspalten, Collections und Bibliothek. Das spart Wechsel zwischen Suchoberfläche, PDF-Leser und erster Materialordnung, verlangt aber klare eigene Evidenzregeln.
Der Anbieter nennt an verschiedenen Stellen 287 Millionen beziehungsweise mehr als 280 Millionen Paper. Seriös lässt sich daraus nur „mehr als 280 Millionen laut Anbieter“ ableiten. Basic war mit 100 Credits pro Monat kostenlos. Premium umfasste 1.200 Credits pro Monat und kostete bei jährlicher Abrechnung 12 US-Dollar monatlich. Da der Creditverbrauch von der Aufgabe abhängt, lässt sich daraus keine feste Zahl gleichartiger Recherchen berechnen.
Für die Auswahl zwischen den drei Produkten hilft eine einfache Reihenfolge: Consensus beginnt bei der Frage, Elicit bei der reproduzierbaren Auswahl und Extraktion, SciSpace beim durchgehenden Arbeitsbereich für Finden, Lesen und Ordnen.
Vom Schlüsselpaper zum belastbaren Literaturpfad
Scite zeigt, wie später zitiert wurde
Scite ergänzt die Originallektüre um den späteren Zitationskontext. „Smart Citations“ kennzeichnet, ob eine Arbeit eine frühere Publikation unterstützend, widersprechend oder lediglich erwähnend zitiert. Der Anbieter meldet mehr als 300 Millionen Quellen und über 1,6 Milliarden Zitationsaussagen; auch diese Zahlen beschreiben den Datenbestand aus Herstellersicht.
Connect bot kostenlos 25 MCP Credits im Monat, jedoch nicht den vollständigen Assistant oder die Suche. Basic enthielt Assistant, Search, Smart Citation Reports, Collections und Alerts. Bei jährlicher Abrechnung lagen die am 30. September 2026 geprüften Monatswerte bei 20 US-Dollar für Basic und 50 US-Dollar für Pro.
Die Labels sind Wegweiser, keine Urteile über Wahrheit oder Studienqualität. Eine widersprechende Zitierung kann methodisch schwach sein; eine unterstützende kann die ursprüngliche Aussage nur am Rand betreffen. Öffnen Sie beide Texte.
ResearchRabbit erweitert das Feld
ResearchRabbit beginnt mit wenigen Startpublikationen, Stichworten oder einer Collection und schlägt anhand von Zitationsbeziehungen und Metadaten benachbarte Arbeiten vor. Die Visualisierung macht Forschungszweige, zeitliche Entwicklung und wiederkehrende Autorinnen und Autoren sichtbar. Das eignet sich besonders, wenn die klassische Stichwortsuche ein Feld nur unvollständig abbildet.
Der kostenlose Tarif erlaubte unbegrenzte Suchen, Libraries, Collections und Zusammenarbeit mit bis zu 50 Seed-Artikeln. RR+ erhöhte die Grenze auf 300 Seeds und ergänzte weitere Projekte, Steuerungsmöglichkeiten und Integrity Signals. Der Preis lag bei 10 US-Dollar pro Monat bei jährlicher Abrechnung oder 12,50 US-Dollar bei monatlicher Zahlung.
ResearchRabbit synthetisiert die Evidenz nicht für Sie. Es erweitert den Suchraum. In Kombination mit Scite entsteht trotzdem ein starker Ablauf: erst die Nachbarschaft einer wichtigen Arbeit kartieren, dann auffällige Folgezitate im Originalkontext prüfen.
Preise und Grenzen im direkten Vergleich
| Tool | Bester Einsatz | Brauchbarer kostenloser Einstieg | Bezahlter Zugang am 30.09.2026 | Hauptgrenze |
|---|---|---|---|---|
| Perplexity | Aktuelle Web-Orientierung | Einfache Suchen fast unbegrenzt; niedrige Pro-/Research-Limits | Kein stabiler Einzelpreis aus den geprüften Seiten | Quellenqualität schwankt |
| ChatGPT Deep Research | Mehrstufiger Bericht aus gemischten Quellen | Abhängig von Konto und Workspace | Preis und Kontingent tarifabhängig | Hoher Aufwand für Quellen- und Interpretationsprüfung |
| Gemini Notebook | Fragen an ausgewählte eigene Quellen | Rechenaufwandsbasierte Limits | Höhere Tarife erweitern Limits; Produktanzeige maßgeblich | Quellenbestand kann lückenhaft sein |
| Consensus | Schnelle wissenschaftliche Evidenzsuche | Paper-Suche plus begrenzte Pro-/Deep-Nutzung | Pro: 20 USD/Monat oder 144 USD/Jahr; Deep: 65 USD/Monat oder 540 USD/Jahr | Keine vollständige systematische Übersichtsarbeit |
| Elicit | Screening und Datenextraktion | Basic mit begrenzten Reports und Suche | Academic Plus: 11 USD/Person/Monat jährlich; Industry Pro: 49 USD/Person/Monat jährlich | Auf Englisch optimiert |
| SciSpace | Akademische Suche, Lektüre und Ordnung | Basic: 100 Credits/Monat | Premium: 12 USD/Monat jährlich, 1.200 Credits | Verbrauch variiert nach Aufgabe |
| Scite | Zitationskontext und Claim-Prüfung | Connect: 25 MCP Credits/Monat | Basic: 20 USD/Monat jährlich; Pro: 50 USD/Monat jährlich | Zitationslabels brauchen menschliche Auslegung |
| ResearchRabbit | Visuelle Literaturerweiterung | Unbegrenzte Suche, bis 50 Seeds | RR+: 10 USD/Monat jährlich oder 12,50 USD monatlich | Entdeckt Literatur, synthetisiert sie aber nicht |
Ein Quellenworkflow, der einer Prüfung standhält
Das beste Werkzeug hilft wenig, wenn Suchweg und Belegauswahl später nicht mehr nachvollziehbar sind. Für normale Markt-, Themen- oder Literaturrecherchen genügt oft ein schlanker Ablauf:
- Frage und Grenze festlegen. Notieren Sie Zeitraum, zulässige Quellentypen, Sprache und gewünschtes Ergebnis.
- Breit entdecken. Nutzen Sie Web- oder Papersuche zunächst für Kandidaten, nicht für fertige Schlussfolgerungen.
- Quellenbestand einfrieren. Speichern Sie Datenbanken, Suchanfragen, Datum und Gründe für Ein- oder Ausschluss.
- Originalbelege sichern. Erfassen Sie für jede wichtige Aussage Textstelle, Seite oder Abschnitt, Veröffentlichungsdatum und Link.
- Gegenbelege suchen. Prüfen Sie spätere, widersprechende und methodisch abweichende Arbeiten, statt nur Bestätigungen zu sammeln.
- Quelle und Deutung trennen. Kennzeichnen Sie, was das Dokument ausdrücklich sagt und was eine redaktionelle oder maschinelle Interpretation ist.
- Vor Abgabe einzeln prüfen. Öffnen Sie jede wesentliche Referenz erneut; folgenreiche Aussagen benötigen menschliche Kontrolle.
Wo eine systematische Übersichtsarbeit beginnt
PRISMA-S hält fest, dass keine einzelne Datenbank eine vollständige und präzise Liste aller relevanten Studien liefert. Eine formale Übersichtsarbeit braucht mehrere Fachdatenbanken, vollständige Suchstrings, dokumentierte Websuchen, Deduplizierung, Qualitätsbewertung, menschliches Screening und ein vorab festgelegtes Protokoll. Die hier vorgestellten Werkzeuge können einzelne Schritte beschleunigen, aber dieses Verfahren nicht ersetzen.
Welches Tool Sie zuerst ausprobieren sollten
Beginnen Sie nicht mit einem Abo, sondern mit einer realen Frage, deren Quellen Sie teilweise schon kennen. Prüfen Sie anschließend, ob das Werkzeug eine bekannte Schlüsselquelle findet, die Aussage korrekt an der Fundstelle verankert, eine relevante Gegenposition entdeckt und das Ergebnis in einem brauchbaren Format ausgibt.
Für einen aktuellen Webüberblick ist Perplexity der pragmatische Start. Ein klar umrissener Bericht mit unterschiedlichen Quellentypen spricht für ChatGPT Deep Research; ein genehmigter Dokumentbestand für Gemini Notebook. Bei wissenschaftlicher Literatur wählen Sie Consensus für die schnelle Evidenzfrage, Elicit für Screening und Extraktion oder SciSpace für einen gemeinsamen Such- und Lesearbeitsplatz. Scite kommt hinzu, wenn die spätere Zitationsgeschichte zählt; ResearchRabbit dann, wenn Sie das Feld von wenigen guten Startpublikationen aus erweitern müssen.
Dokumentieren Sie bei diesem Probelauf Auslassungen, falsche Zuordnungen und unklare Zitate. Erst wenn das Werkzeug in Ihrem Quellenrahmen eine prüfbare Belegspur liefert, lohnt sich die Entscheidung für einen kostenpflichtigen Tarif.



