Arbiva Demo
← 回到 BP

同一次搜索,大模型少读

今天:10 条全部给大模型(按 Exa 价计)
Arbiva:只把值得读的给大模型
大模型要读的 token
客户每次搜索的账单
每 100 万次搜索省下

真实调用 Parallel Search(Turbo,$0.001 / 次)召回,判断暂用 TypeSafe Jev 代跑($0.042 / 百万 token)。账单按客户视角算:“今天”一栏按 Exa $0.007 / 次,Arbiva 按 $0.005 / 次,大模型按 Opus 5 输入价 $5 / 百万 token。

Agent 每走一步,大模型只读 3 个工具

整个任务,大模型要读的工具定义
整个任务的账单
每 100 万个任务省下

今天的做法:每一步都把全部 87 个工具定义塞给大模型,每个按 950 token 估算(Anthropic《Advanced tool use》:58 个工具定义约 55K token)。任务的分步为预设,每步真实调用判断,暂用 TypeSafe Jev 代跑。账单按 Opus 5 输入价 $5 / 百万 token,Arbiva 按 $1 / 千次。