传统请求
每次重新计算。
每个请求都经过完整的模型计算路径,因此延迟和成本更高。
平台与技术
一次连接,企业即可接入所有模型,底层的网关、缓存、路由、计量和 GPU 等复杂性由 Indosat 负责管理。
架构分层
不同组合决定成本。Indosat 运营本地模型的技术栈,并将您连接到全球模型。
优化
传统请求
每个请求都经过完整的模型计算路径,因此延迟和成本更高。
缓存请求
完全匹配的缓存命中直接从网关返回已保存的响应。无需调用模型,也不产生模型 API 费用。
< 10 ms
从网关返回完全匹配的缓存结果,无需调用模型
性能
Indosat 本地托管模型
纳米 / 边缘
1B
低延迟的快速 AI,适用于实时和简单任务。
小型 / 高效
7B+
日常企业任务与自动化。
企业级
30B
复杂工作流与行业场景。
近前沿
70B
面向专业场景的高级推理。
前沿
100B+
研究、创新与关键场景。