LLM 与学术检索 API 的三条实测行为
在调用几个模型接口和学术检索接口的过程中,遇到了三个不太明显的行为,记录在这里。
第一个和 Gemini 的模型名有关。gemini-2.5-flash 在 v1beta generateContent 端点正常返回;gemini-2.0-flash 在同一端点返回 HTTP 404。同一个 API key、同一个请求体,只改模型名,一个成功一个 404。说明 404 来自模型名解析而非鉴权。
第二个和 arXiv 的接口地址有关。arXiv export API 的 http:// 端点返回 301;curl 不加 -L 会得到 0 字节文件。失败不是报错退出,而是静默产出空文件,下一步解析才炸,报 'no element found: line 1, column 0' —— 错误信息指向解析器,真正原因在上一步的重定向。
第三个和 OpenAlex 的过滤参数有关。OpenAlex /works 加 filter=type:article 会排除 preprint,对 2023 年后出现的新概念几乎检索不到有效结果。同一个检索词,OpenAlex 返回的条目与主题无关;arXiv API 返回大量直接相关的论文。新领域的成果主要以 preprint 形式存在,被 type:article 过滤掉了。
这三个问题的共同点是,失败的表现形式和真正的原因不在同一个地方,所以排查时容易找错方向。