Flue模型选择指南:Pi全家桶Provider支持与LLM选型建议 Flue模型选择指南Pi全家桶Provider支持与LLM选型建议【免费下载链接】flueThe sandbox agent framework.项目地址: https://gitcode.com/GitHub_Trending/flue1/flueFlue是一个开源的沙箱智能体Agent框架它构建在Pi模型层之上开箱即支持 Pi 全家桶的 LLM Provider——Anthropic、OpenAI、Google、Bedrock、Groq、DeepSeek、Mistral 等。你只需一行useModel()就能完成模型选择与 Provider 配置无需手动管理 SDK、API Key 和流式请求。本文为你梳理 Flue 的模型声明方式、Provider 支持范围与一套实用的LLM 选型建议帮新手快速挑对模型、控好成本。一、如何声明模型useModel 一行搞定在 Flue 中每个 Agent 由一个且仅一个 LLM驱动通过useModel()钩子声明。它只是点名不是 SDK 客户端——连接、鉴权、流式、重试全部由运行时托管useModel(anthropic/claude-sonnet-4-6);模型标识符采用provider-id/model-id格式以第一个/为界拆分anthropic/claude-sonnet-4-6→ Provider 是anthropic模型是claude-sonnet-4-6openrouter/moonshotai/kimi-k2.6→ 模型 ID 本身可以含斜杠cloudflare/cf/moonshotai/kimi-k2.6→ 在 Cloudflare Workers AI 上运行免 API Key标识符写错会在发送任何请求之前快速报错fail fast方便你第一时间发现拼写问题。规则详见 models.md。二、Pi 全家桶 Provider 支持开箱即用的模型清单Flue 的默认 Provider 集合直接来自 Pi 的 Provider 目录内置注册表定义在 builtin-providers.ts。主要 Provider 包括Provider说明anthropicClaude 系列读ANTHROPIC_API_KEYopenaiGPT 系列读OPENAI_API_KEYgoogleGemini读GEMINI_API_KEYamazon-bedrock/google-vertex企业级云平台groq/cerebras/together/fireworks高性价比推理加速deepseek/mistral/xai开源与新兴模型openrouter一站式聚合网关cloudflareWorkers AI无需任何 API Key仅限 Cloudflare 目标每个 Provider 的目录条目都自带模型元数据上下文窗口、输出上限、成本费率、推理能力、输入模态是否支持图片。这些元数据决定了 Flue 何时触发对话压缩、思考档位是否真正生效、图片附件能否被接受——所以选型时认准目录里的模型行为最可预期。如果你只用其中几家可以在构建配置中收敛让打包产物更精简// vite.config.ts flue({ providers: [anthropic, openai] });列表一旦显式设置就是穷举式的未列出的 Provider 会解析失败。语义详见 provider-api.md。三、模型调优思考档位与自动压缩useModel()的第二个参数提供两个调优项是LLM 选型之外的第二层旋钮1. 思考档位thinkingLevel—— 取值从off到maxminimal/low/medium/high/xhigh默认medium。高档位换更深的推理代价是延迟与 token只有被标记为支持推理的模型才真正把档位发到服务端。2. 对话压缩compaction—— 当对话接近上下文窗口上限时Flue 自动把较早的历史折叠成摘要、保留近期消息原文让长对话永生。其中compaction.model支持指定一个更便宜的模型专门做摘要例如useModel(anthropic/claude-opus-4-6, { compaction: { model: anthropic/claude-haiku-4-5 }, });主模型顶格输出、副模型便宜兜底——这是控成本的关键技巧。四、LLM 选型建议便宜的先跑难的再升级Flue 的 Agent 每次模型调用前都会重新渲染useModel()的参数可以是动态计算的。官方推荐的经典模式是升级流escalation默认用便宜快速的模型遇到难题时通过持久化状态切换到强模型。据此给新手的三条选型建议日常对话与分类任务用轻量模型如anthropic/claude-haiku-4-5或groq系模型响应快、账单低。复杂推理与代码审查升级到anthropic/claude-opus-4-6这一档并把thinkingLevel调到high。零成本起步部署在 Cloudflare 上时用cloudflare/...标识符走 Workers AI不需要任何 API Key还有内置 AI Gateway 提供缓存、日志与预算控制。注意模型选择是提交级生效的一次消息处理过程中切换的模型从下一条消息开始才切换不会出现半路换脑。五、进阶自定义 Provider 与本地模型内置目录覆盖不到的场景——本地 Ollama、自建代理网关、刚发布的模型——可以用 Pi 的createProvider()构建 Provider再通过setProvider()注册到 FluesetProvider( createProvider({ id: ollama, models: [{ id: llama3.1:8b, baseUrl: http://localhost:11434/v1, /* ... */ }], api: openAICompletionsApi(), }), );之后就能像内置模型一样写useModel(ollama/llama3.1:8b)。同理用内置 ID 注册一个自定义 Provider 即可把 Anthropic/OpenAI 路由到网关Agent 代码一行不用改。任何 OpenAI 或 Anthropic 兼容端点都适用。六、快速上手3 步接入你选的模型安装运行时npm install flue/runtime flue/cli然后创建 flue.config.ts 与 Agent 文件完整步骤见 getting-started.mdx。放入 API Key在项目根目录.env中按 Provider 约定的变量名写入密钥如ANTHROPIC_API_KEY、OPENAI_API_KEYflue run与vite dev都会自动加载且永不提交进仓库。本地验证npx flue run src/agents/assistant.ts --message ...确认模型解析与密钥无误后再部署。部署环境Node.js 或 Cloudflare Worker只读真实环境变量不加载.env请通过宿主平台的密钥机制注入。小结选型维度建议新手首选anthropic/claude-haiku-4-5便宜且行为稳定复杂任务Opus 级模型 thinkingLevel: high成本敏感便宜模型跑主流程 摘要卸载到更便宜的compaction.model零 Key 部署Cloudflare 目标下的cloudflare/...Workers AI 模型私有化用setProvider()接入本地 Ollama 或网关Flue 把选模型变成了一句声明式代码把 Provider 生态的复杂度留给了 Pi 全家桶。选对模型、管好预算剩下的交给框架。【免费下载链接】flueThe sandbox agent framework.项目地址: https://gitcode.com/GitHub_Trending/flue1/flue创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

最新新闻

AI造病毒?拆解AI在病毒研究中的真实角色与安全边界

AI造病毒?拆解AI在病毒研究中的真实角色与安全边界

“科学家用 AI 造出 16 种新病毒”这条新闻,讨论热度很高,但如果你把它理解成“AI 现在已经能随手造病毒”,方向就偏了。我梳理了同类研究和 AI 在生物信息学里的常见流程后,建议先把三件事拆开看:AI 完成了哪一步&…

2026/8/30 11:33:28
用Rust和Tauri实现Windows内存整理工具:从原理到打包

用Rust和Tauri实现Windows内存整理工具:从原理到打包

最近在 Windows 下实现一个轻量级内存整理工具 RAMGuard Pro 时,我选择了 Rust Tauri 这套组合。整个项目落地下来,体验比想象中顺畅,但也踩了不少 Windows API、权限、系统内存机制相关的坑。 这篇文章会从项目背景、技术选型、环境搭建、…

2026/8/30 11:33:28
STM32CubeIDE与CubeProgrammer协同调试全攻略

STM32CubeIDE与CubeProgrammer协同调试全攻略

1. 从两个工具的分工说起:为什么需要协同调试先说个实际场景。很多人在用STM32CubeIDE做开发的时候,会遇到一个不太舒服的情况:项目编译已经过了,程序也下载进去了,但想看一下片子内部的FLASH内容、想改一下选项字节、…

2026/8/30 11:33:28
ROSS Harness夺工业场景赛前三:拆解具身智能全自主闭环的工程逻辑

ROSS Harness夺工业场景赛前三:拆解具身智能全自主闭环的工程逻辑

ROSS Harness 能在世界人形机器人运动会工业场景赛里拿到全国前三,说明一个问题:人形机器人和具身智能的竞赛价值已经不只是演示,而是开始检验工业落地能力。过去几年,人形机器人比赛多集中在行走、抓取、对话这些单点能力上&…

2026/8/30 11:33:28
2017牛客二模Python真题拆解:从字符串到动态规划,校招笔试基本功

2017牛客二模Python真题拆解:从字符串到动态规划,校招笔试基本功

说实话,2017年牛客网的二模,我印象还挺深的。那年头没有现在这么多花里胡哨的刷题平台,牛客模考几乎是每个准备秋招的人必刷的模拟战场。我当时把这套二模题目翻来覆去做了一遍,后来又在各种笔试里撞见了好几个类似的变体。现在回…

2026/8/30 11:33:28
Redis缓存面试题精讲:穿透、击穿、雪崩与分布式锁实战

Redis缓存面试题精讲:穿透、击穿、雪崩与分布式锁实战

这周连着面了好几场后端岗位,几乎每一场我都会问Redis相关的问题。“缓存穿透怎么防?”“分布式锁有没有遇到过坑?”“缓存和数据库的一致性怎么保证?”这三连问基本是后端面试的保留曲目。这一期常见面试题精讲,我单独…

2026/8/30 11:28:28