יום שלישי, 15 בספטמבר 2026 LIVE
AI־INFO

כתבה arXiv cs.CL ·

דיוק דומה, ראיות שווה: API של חיפוש כפני החלטה לאגנטים

Similar Accuracy, Unequal Evidence: Search APIs as Decision Surfaces for Tool-Using Agents
API של חיפוש כפני החלטה לאגנטים: ניתוח של API של חיפוש כפני החלטה לאגנטים. המחקר ניתח API של חיפוש כפני החלטה לאגנטים ומצא שהם יכולים לשמש כפני החלטה לאגנטים. המחקר גם חקר את השימוש ב-API של חיפוש כפני החלטה לאגנטים ומצא שהם יכולים לשמש כפני החלטה לאגנטים.
תקציר מקורי באנגליתarXiv:2607.10198v2 Announce Type: replace Abstract: Search APIs expose ranked snippets, URLs, and metadata on which agents decide whether to answer, search again, or fetch pages. We evaluate these interfaces as decision surfaces on a fixed sample of 100 questions from the 254-question SealQA-Hard subset, using one frozen GPT-5.4 agent, a fixed orchestration harness, and a shared page-fetch backend across Brave, Tavily, and Firecrawl. A Kimi-K2.6 oracle labels visible URL-level evidence; a separate answer audit yields 25, 25, and 26 correct answers out of 100. These counts indicate similar observed accuracy but do not establish equivalence. Under the tested configurations, Brave exposes more pre-fetch support alongside a larger snippet surface; Tavily has a larger rank-1 share among traject
קרא במקור המקורי