🔍 Il benchmark di ricerca più difficile in circolazione — vago, multi-turno, proattivo. 200 compiti a lungo termine con divulgazione progressiva guidata dalla persona, valutati da una valutazione di grafo della conoscenza senza schema verificabile. Niente vibrazioni, solo triplet F1.
Testa le capacità di ricerca AI con domande complesse e multi-passaggio e valuta le loro prestazioni utilizzando un sistema di punteggio.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoi🔍 Il benchmark di ricerca più difficile in circolazione — vago, multi-turno, proattivo. 200 compiti a lungo termine con divulgazione progressiva guidata dalla persona, valutati da una valutazione di grafo della conoscenza senza schema verificabile. Niente vibrazioni, solo triplet F1.
VibeSearchBench ha 915 stelle su GitHub. È stato forkato 62 volte. VibeSearchBench è scritto principalmente in Python. È in sviluppo attivo dal 2026. VibeSearchBench è disponibile con licenza MIT. I suoi temi principali sono: agentic-ai, benchmark, llm, proactive-agent.
🔍 Il benchmark di ricerca più difficile in circolazione — vago, multi-turno, proattivo. 200 compiti a lungo termine con divulgazione progressiva guidata dalla persona, valutati da una valutazione di grafo della conoscenza senza schema verificabile. Niente vibrazioni, solo triplet F1.
VibeSearchBench è un progetto open source. È rilasciato con licenza MIT.
Sì. VibeSearchBench è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
VibeSearchBench è disponibile con licenza MIT.
VibeSearchBench è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/vibebench-vibesearchbench.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.