freellmpool:一个本地MCP网关,聚合免费的LLM端点
freellmpool,由0xzr开发,是一个开源的模型上下文协议(MCP)服务器和API网关,将数十个大型语言模型的免费层聚合到一个本地端点。该工具汇集了多个托管提供者,暴露了一个与OpenAI兼容的接口,并提供路由、使用跟踪和无密钥快速启动路径以便于立即测试。针对开发者和AI编码用户,它减少了在代理开发过程中处理多个提供者SDK和密钥的工作量。
聚合许多托管模型并为代理提供MCP原生工具
freellmpool作为MCP服务器运行,目录中有超过24个提供者和400多个聊天模型,同时为AI客户端提供专门的工具,如'ask'、'battle'和'recipe'。该工具包括Codex风格和Anthropic风格消息的适配器,并列出了与MCP兼容客户端的兼容性,例如Claude Desktop和Cursor。
- 提供者目录:24+提供者
- 模型目录:400+聊天模型
- 代理目标:编码代理,如Claude Code、Cursor
路由和冷却逻辑保持请求流,但依赖于外部可用性
自动故障转移和路由重定向请求,当提供者返回速率限制错误或离线时,该工具应用智能冷却,暂停达到限制的提供者,以避免重复的429错误。使用跟踪监控每日消耗,因此负载分配;因此,相对于单一提供者设置,连续性得到改善,而实际的正常运行时间和吞吐量仍然与汇聚的免费服务相关。
实验的低设置集成,适用于持续工作负载的实际限制
安装和集成目标是快速实验:该工具通过Python(pip)安装,支持跨桌面平台的CLI使用,并提供与OpenAI/Anthropic兼容的代理,以便现有软件在不更改代码的情况下接受本地端点。无密钥快速启动可立即访问某些提供者,用户可以添加自己的密钥以获得更高的配额。由于它聚合了免费层,该工具适合原型设计和代理测试,而不是保证的高容量生产运行。
实验的实用选择,不太适合保证生产吞吐量
freellmpool 是开发者和 AI 编码用户的实用选项,他们需要通过单个本地端点快速访问许多托管模型;模型的行为和可用性反映上游提供商,因此预计会有与这些免费层相关的变动。如果需要持续的容量或更严格的正常运行时间保证,请将输出视为上游模型的响应,并补充提供商密钥。