AI NetCafe

Compare LLM cost & latency on one prompt, translate PDF keeping layout, cited research, make PPTX

Documentation

给 AGENT 的入口

让你的 Agent 直接上机

AI 网吧提供 MCP 服务端。你的 agent 可以直接调用开源应用目录、多模型对比和真实计费——不用注册就能试,按次结算,每次调用都返回精确到 $0.0001 的花费。

接入地址

https://ainetcafe.com/mcp

传输方式 Streamable HTTP / 协议版本 2025-06-18 / 发现清单 /.well-known/mcp.json

一行接入

Claude Code

claude mcp add --transport http ai-netcafe https://ainetcafe.com/mcp

Claude Desktop / Cursor(配置文件)

{
  "mcpServers": {
    "ai-netcafe": {
      "type": "http",
      "url": "https://ainetcafe.com/mcp"
    }
  }
}

免费额度用完后,加一行 "headers": { "Authorization": "Bearer sk-你的AllRouter Key" } 即可无限用(走你自己的账单)。

五个工具

compare_models

同一个提示词同时跑多个模型,返回每个模型的答案 + 真实计量的花费和延迟。回答"这个任务到底该用哪个模型"——用数据,不是猜。

ask_model

指定单个模型跑一次,返回答案和精确花费。适合让 agent 找个便宜模型干批量子任务,或换个模型要第二意见。

list_apps

列出网吧里托管好的开源 AI 应用(PDF 保版式翻译 / 做 PPT / 学术润色 / 自主研究 agent 等),含仓库地址和可直接打开的链接。

get_app

单个应用的详情:怎么用、实测评分、开源协议、真人使用量。

list_models

全部可调模型 + 每百万 token 的输入/输出单价,让 agent 按成本选型。

为什么值得接

下面是 compare_models 在本站的一次真实调用——同一个问题、三个模型,答案基本一样

模型花费延迟答案
deepseek-v4-flash$0.0001097.1sThe capital of France is Paris.
GLM5.2$0.0003664.2sThe capital of France is Paris.
gemini-3.5-flash$0.00532010.2sParis.

最贵的比最便宜的贵 48.8 倍

而且它还最慢、答得最短。如果 agent 要跑几千次子任务,选型差一档就是几十倍的账单差距——这正是这个工具存在的意义。

额度与计费

· 不带 Key:走免费池,按调用方 IP 记额度,够试用。用完会返回明确提示。

· 带 AllRouter KeyAuthorization: Bearer sk-...,无限量,走你自己的账单。

· 每次调用都返回 cost_usd,是实际计量值(读上游 usage),不是估算。

旗舰模型需要自带 Key;免费池只开放性价比档,避免被单次任务烧穿。

直接试一下

不用装任何东西,复制到终端就能跑:

curl -s https://ainetcafe.com/mcp \
  -H 'Content-Type: application/json' \
  -d '{"jsonrpc":"2.0","id":1,"method":"tools/call",
       "params":{"name":"compare_models",
                 "arguments":{"prompt":"用一句话解释 MCP 是什么"}}}'