启动 HN: Tokenless (YC S26) – 自动模型切换以节省开支
Tokenless 是您 API 调用的即插即用替代品——始终路由到正确的模型。相同的质量,只有一半的成本。大多数请求并不需要前沿模型。Tokenless 将您的请求分配给一组模型并观察它们的思考过程。一旦某个模型明显在正确轨道上,我们就会选择它并取消其他模型,您只需为需要的部分付费。我们提供与 OpenAI 和 Anthropic 兼容的端点。将您的模型对准我们,今天就开始吧!> 将 CLI 选项重构为枚举时间 → 信心,每个模型此请求 $0.0000 $0.0000 发送给 Fable 5 $0.0000 $0.0000 −52% · 从未收费。已测量,而非营销。质量与成本在公共编码基准上——与 Opus 4.8 相同的质量,但每个任务的成本却少了许多。60% 70% 80% 90% $0.20 $0.50 $1 $2 $5 ← $ / 任务 (对数) 解决 → PROGPT 5.5 Opus 4.8 MAX 模型解决 $ / 任务与便宜的对比。PRO 72% $0.32 -57% GPT 5.5 76% $0.74 — Opus 4.8 72% $2.41 — MAX 82% $6.70 — PRO GPT 5.5 Opus 4.8 MAX TerminalBench 2.1 解决率 72% 76% 72% 82% $ / 任务 $0.32 $0.74 $2.41 $6.70 与最低费用相比 -57% — — — LiveCodeBench 解决率 89.0% 85.7% 88.9% 90.4% 总计 $ $74.78 $84.27 $80.01 $85.33 与最低费用相比 -7% — — — 需要最大质量而非最大节省?MAX 将每个任务路由到最佳可用模型。看看您能节省什么。您的每月 LLM 开支 您的每月账单 $14K /月 减少您的账单 * 您支付 $26K/月 节省 $14K/月 您支付 $26K/月 节省 $14K/月 $0 $40K/月 — 您今天的账单 您未来 12 个月的趋势:RAMP AI 指数 · +11.0%/月 $20K/月 $40K/月 $60K/月 $80K/月 $100K/月 $120K/月 当前与 tokenless 的轨迹 $344K 在下一年节省 — 12 个月今日 +12 个月 新每月账单 $26K/月 混合节省率 34% 请求重新路由 42% 当前账单 $40K/月 * 估算使用了已发布的代币价格(包括缓存率)和源中的可编辑路由假设。您的费率取决于您的流量。消费历史与趋势:Ramp AI 指数 — 每个员工的 AI 花费,2025 年 6 月至 2026 年 6 月,匹配您的消费所在的组别,并按其过去 12 个月的增长进行外推。由来自 Google DeepMind、普林斯顿大学和加州大学伯克利分校的 AI 研究人员构建。得到 Y Combinator 的支持。削减账单,保持质量。预约演示,我们将根据您的实际流量进行运算——或交换两行亲自体验。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡