Funkční test 14 MCP serverů pro akademickou a právní rešerši — 6 paralelních agentů, výhradně read-only operace, dotazy z domény diplomky (zastoupení, plná moc), aby se kromě konektivity dala posoudit i kvalita výsledků.
Root cause byla nekonvergující restart smyčka ONNX embedding workeru (30/60s timeouty → recoverWorker() → načítání 543MB modelu od nuly → smyčka; HTTP handler se nikdy nevrátil a strhl celý HTTP server Zotera — mechanismus „zamrzlého Zotera“; dokázáno diskriminačně: /zotseek/similar bez workeru doběhl za 219 s, semantic s workerem nikdy). Oprava: přepnutí na server-backed embedding přes Ollamu (server:bge-m3-latest) — cestou objeven další bug: Test connection neposílá API klíč, takže poskytovatelé vyžadující token (Msty Nexus) přes UI nejdou. Starý index (659 tis. chunků, 6 dní indexace) zachráněn SQL přeštítkováním model_id při vypnutém Zoteru (záloha zotseek.sqlite.bak-20260822). Ověřeno end-to-end: studený semantic dotaz doběhl za 193 s; teplá cache pak vrací za sekundy pasáže s čísly stránek a zotero:// deep linky. Vzor použití přes MCP: studený dotaz timeoutuje (60s limit klienta) a ~3 min blokuje HTTP server Zotera, ale naplní ~5min cache → zopakovat do 5 minut a sémantické dotazy dávkovat. Volitelně: excludeBooks + rebuild přes Ollamu (menší sklad = kratší studený load); upstream bug report.
notebooklm-mcp po nlm login (21. 8.) plně funkční — 37 notebooků. Nadbytečný druhý server notebooklm (samostatný balíček npx notebooklm-mcp@latest, lokální scope, nepřihlášený) byl odstraněn. Zbývá volitelně upgrade balíčku 0.9.4 → 0.9.14 (uv tool upgrade notebooklm-mcp-cli).
OAuth token expiroval — všechna volání se okamžitě a opakovaně vracejí s „requires re-authorization“. Americká komparatistika (power of attorney) je do obnovení nedostupná.
BASE a CORE vyžadují API klíč, Unpaywall povinný email parametr — všechny tři teď tiše vracejí prázdno. HAL a Zenodo mají reprodukovatelný serverový bug ('str' object has no attribute 'isoformat') — kandidát na upstream issue. SSRN je blokován WAF; náhradou jsou SSRN preprinty přes Crossref (DOI prefix 10.2139).
Dotaz na EUR-Lex WS proběhne (3 585 zásahů), ale položky mají celex, nazev i typ_dokumentu = null — výsledky nejde identifikovat. Vypadá na chybu mapování polí odpovědi v pravo-cli. Do opravy pro EU právo používat eurlex_get s konkrétním CELEX.
Index serveru 54yyyu (228 527 chunků) je z 15. 8. — položky přidané v posledním týdnu semantic search nevidí. Zvážit zotero_update_search_database.
| Server | Stav | Zjištění |
|---|---|---|
| openalex | ✔ funkční | health_check „healthy“ (v0.5.0, cache zapnutá, běží na anonymním limitu — bez e-mailu/API klíče). Kompletní metadata vč. FWCI, OA statusu a referencí. Pozor: právní víceslovné fráze bez exact_phrase rozpadá na slova — relevance pak slabá. |
| semantic-scholar | ✔ funkční | Bez rate-limitů při testu. Dobrý pro anglosaskou law-and-economics literaturu; u starších právnických článků chybí abstrakty i DOI (mezera dat S2, ne chyba serveru). |
| consensus | ✔ funkční | Nejrelevantnější výsledky ze všech serverů pro téma plné moci (Ries 2026, Stelma-Roorda 2021, O'Sullivan 2021). Free tier = 10 výsledků na dotaz, plné abstrakty. |
| papersflow | ✔ funkční | Guest režim bez omezení testovaných operací. Search je fakticky duplikát OpenAlexu (stejná W-ID i pořadí). Hodnotný je verify_citation: normalizace DOI, plná metadata, 6 citačních formátů + BibTeX. |
| scite | ✔ funkční | 5/5 testů prošlo přes lokální auth-proxy (:8785 odpovídá). Enterprise full-textové čtení OA článků po sekcích funguje výborně; přístupové odkazy se resolvují přes ezproxy NTK. Smart Citations (supporting/contrasting) mají u právní doktríny řídké pokrytí — tally jen u 1/5 hitů. Patentová DB funguje (30 123 rodin na testovací dotaz). |
| Backend | Stav | Poznámka |
|---|---|---|
| search_crossref | ✔ | Nejlepší pro právo: DOI vždy, výborná relevance, pokrývá i SSRN preprinty (prefix 10.2139) |
| search_openaire | ✔ | Silné pro evropskou/českou produkci — našel i českou práci o zastoupení v OSŘ |
| search_doaj | ✔ | Kvalitní OA právnické časopisy vč. srovnávacího práva |
| search_openalex | ✔ | Citační počty + PDF odkazy; relevance střední |
| search_pubmed / _europepmc | ✔ | Výborná relevance, plná metadata |
| search_dblp / _iacr | ✔ | CS bibliografie / kryptografické preprinty, dle zaměření |
| search_biorxiv / _medrxiv | ✔ | Jen filtr kategorií za posledních 30 dní, ne fulltext dotaz |
| search_papers (agregátor) | ✔ | Doporučený vstupní bod — dedup, per-source statistiky, chyby backendů hlásí explicitně |
| search_arxiv | ◐ s výhradou | Funguje, ale volné OR-párování kazí relevanci |
| search_pmc | ◐ s výhradou | Vrací výsledky, relevance špatná |
| search_semantic | ◐ nestabilní | 2 ze 3 dotazů prázdné (rate-limit S2 bez klíče); když projde, metadata špičková |
| search_ssrn | ✘ blokován | WAF blokuje scraping, tiše vrací prázdno — pro právo nejcennější zdroj; náhrada přes Crossref |
| search_base / _core | ✘ bez klíče | Tiché prázdno — vyžadují API klíč / registrovanou IP |
| search_unpaywall | ✘ konfigurace | Prázdno i pro prokazatelně OA DOI — zřejmě chybí povinný e-mail parametr |
| search_hal / _zenodo | ✘ bug serveru | Reprodukovatelně: 'str' object has no attribute 'isoformat' |
| search_citeseerx | ✘ mrtvý | Prázdno i na neutrální dotazy, bez chybové hlášky |
| search_google_scholar | ✘ bot-block | Známé omezení Scholaru, ne vada serveru |
| download_arxiv + read_arxiv_paper | ✔ | PDF staženo (2,2 MB, validní) a plný text extrahován vč. tabulek a referencí |
| Sci-Hub nástroje | — netestováno | Záměrně vynecháno z právních důvodů |
Zákeřný vzorec: rozbité backendy (SSRN, BASE, CORE, Unpaywall, CiteSeerX) vracejí prázdný výsledek bez chyby — nikdy neinterpretovat jako „literatura neexistuje“.
| Server | Stav | Zjištění |
|---|---|---|
| zotero (54yyyu) | ✔ plně funkční | Substring search s diakritikou OK („plná moc“ → 4/5 relevantních), semantic search přes bge-m3/ollama OK (5/5 relevantních s pasážemi), metadata kompletní. Index: 228 527 chunků, poslední update 15. 8. Nezávisí na běžící aplikaci Zotero. |
| zotseek | ✔ od 22. 8. | Plně funkční po přepnutí na Ollama embedding (server:bge-m3-latest) a přeštítkování indexu. Semantic vrací pasáže s čísly stránek a zotero:// deep linky. Studený dotaz = ~3 min načítání skladu (blokuje HTTP server Zotera, MCP klient timeoutuje) → nahřát a ptát se do 5 min, kdy je cache teplá. Keyword mód bez omezení. |
| server-zotero (cookjohn) | ✔ od 21. 8. | Po restartu Zotera transport ožil — get_libraries vrací knihovny (My Library, dz-bz, feedy). Ranní výpadek byl důsledkem zamrzlé aplikace, ne serveru. |
Ranní nález „zamrzlé Zotero“ se restartem potvrdil a z větší části vyřešil; jako trvalý problém zbývá rozbitý semantic/hybrid mód ZotSeeku. Sémantiku pokrývá server 54yyyu, hloubkový fulltext cookjohn search_fulltext s itemKeys.
| Nástroj | Stav | Zjištění |
|---|---|---|
| pravo · predpis_* | ✔ | Řetězec search → ustanovení → get vrací autoritativní text § 441 OZ věcně správně vč. poslední věty z novely 460/2016 Sb., s plnou citací, novelizačním řetězcem a CSL záznamem. Kvóta e-Sbírky 62/500. |
| pravo · judikat_search | ✔ | ÚS: 522 zásahů k plné moci, sp. zn. + ECLI + data. NS záměrně netestován (nástroj sám varuje — robots.txt). |
| pravo · justice_search | ✔ | Funguje (~20 s, bez dřívějších 504). Pozor: je to fulltext rozhodnutí nižších soudů, ne obchodní rejstřík. |
| pravo · pojem_search | ◐ | Technicky OK, ale „plná moc“ v top-5 tezauru chybí (vrací „plná svéprávnost“, „moc zákonodárná“…) — pro tento pojem nepoužívat. |
| pravo · eurlex_search | ◐ | Dotaz proběhne, ale položky mají celex/název/typ = null — prakticky nepoužitelné do opravy mapování. eurlex_get s CELEX pravděpodobně funguje (netestováno). |
| Descrybe | ✘ auth | „requires re-authorization (token expired)“ — okamžitě a persistentně. Re-autorizace přes /mcp. |
| Server | Stav | Zjištění |
|---|---|---|
| notebooklm-mcp | ✔ od 21. 8. | Po nlm login server automaticky převzal nové credentials a notebook_list vrací všech 37 notebooků vč. tezí relevantních (REZA — 47 zdrojů, Suomi.fi e-Authorizations, EUDI wallets). Doporučen upgrade 0.9.4 → 0.9.14. |
| notebooklm (2. server) | — odstraněn | Samostatný browser-based balíček (npx notebooklm-mcp@latest, lokální scope), nesouvisel s instalací notebooklm-mcp-cli, nepřihlášený a bez využití — 21. 8. odregistrován (claude mcp remove notebooklm -s local). |
| readwise | ✔ | Reader i highlights API rychlé a korektní (331 highlights, enrichment funguje, response_fields šetří payload). Bez výhrad. |
| Scholar Gateway (Wiley) | ✔ od 21. 8. | Po OAuth přihlášení nabízí semanticSearch — full-textové pasáže z Wiley korpusu (poslední aktualizace květen 2026) s citačními metadaty. Test na safeguards u EPA vrátil 8 relevantních pasáží ze 4 článků (Tilse 2013, Sabatino 2010, Ries 2026) — přímé zásahy do tématu diplomky. |