AI NetCafe
Compare LLM cost & latency on one prompt, translate PDF keeping layout, cited research, make PPTX
Documentation
给 AGENT 的入口
让你的 Agent 直接上机
AI 网吧提供 MCP 服务端。你的 agent 可以直接调用开源应用目录、多模型对比和真实计费——不用注册就能试,按次结算,每次调用都返回精确到 $0.0001 的花费。
接入地址
https://ainetcafe.com/mcp
传输方式 Streamable HTTP / 协议版本 2025-06-18 / 发现清单 /.well-known/mcp.json
一行接入
Claude Code
claude mcp add --transport http ai-netcafe https://ainetcafe.com/mcp
Claude Desktop / Cursor(配置文件)
{
"mcpServers": {
"ai-netcafe": {
"type": "http",
"url": "https://ainetcafe.com/mcp"
}
}
}
免费额度用完后,加一行 "headers": { "Authorization": "Bearer sk-你的AllRouter Key" } 即可无限用(走你自己的账单)。
五个工具
compare_models
同一个提示词同时跑多个模型,返回每个模型的答案 + 真实计量的花费和延迟。回答"这个任务到底该用哪个模型"——用数据,不是猜。
ask_model
指定单个模型跑一次,返回答案和精确花费。适合让 agent 找个便宜模型干批量子任务,或换个模型要第二意见。
list_apps
列出网吧里托管好的开源 AI 应用(PDF 保版式翻译 / 做 PPT / 学术润色 / 自主研究 agent 等),含仓库地址和可直接打开的链接。
get_app
单个应用的详情:怎么用、实测评分、开源协议、真人使用量。
list_models
全部可调模型 + 每百万 token 的输入/输出单价,让 agent 按成本选型。
为什么值得接
下面是 compare_models 在本站的一次真实调用——同一个问题、三个模型,答案基本一样:
| 模型 | 花费 | 延迟 | 答案 |
|---|---|---|---|
| deepseek-v4-flash | $0.000109 | 7.1s | The capital of France is Paris. |
| GLM5.2 | $0.000366 | 4.2s | The capital of France is Paris. |
| gemini-3.5-flash | $0.005320 | 10.2s | Paris. |
最贵的比最便宜的贵 48.8 倍
而且它还最慢、答得最短。如果 agent 要跑几千次子任务,选型差一档就是几十倍的账单差距——这正是这个工具存在的意义。
额度与计费
· 不带 Key:走免费池,按调用方 IP 记额度,够试用。用完会返回明确提示。
· 带 AllRouter Key:Authorization: Bearer sk-...,无限量,走你自己的账单。
· 每次调用都返回 cost_usd,是实际计量值(读上游 usage),不是估算。
旗舰模型需要自带 Key;免费池只开放性价比档,避免被单次任务烧穿。
直接试一下
不用装任何东西,复制到终端就能跑:
curl -s https://ainetcafe.com/mcp \
-H 'Content-Type: application/json' \
-d '{"jsonrpc":"2.0","id":1,"method":"tools/call",
"params":{"name":"compare_models",
"arguments":{"prompt":"用一句话解释 MCP 是什么"}}}'