AI Gateway:从后端调度到成本治理
通过多后端模型访问场景,理解 AI Gateway 如何处理资源调度、容量控制、故障切换、分布式状态、用量统计和企业成本治理。
短文
约 23 分钟阅读
收录于专栏 技术规划与架构 · 第 9 篇
标签
围绕“Systems Design”的写作、研究、项目与影像。
通过多后端模型访问场景,理解 AI Gateway 如何处理资源调度、容量控制、故障切换、分布式状态、用量统计和企业成本治理。
短文
约 23 分钟阅读
收录于专栏 技术规划与架构 · 第 9 篇
内容、搜索、交易和增长系统在多国家、多行业和多场景下会反复遇到同一个问题:如何复用稳定能力,又让业务表达保持差异。配置、协议、组件和编排,应该怎样划分边界。
短文
约 15 分钟阅读
收录于专栏 技术规划与架构 · 第 8 篇
以一套多层执行服务为例,拆解请求身份、边缘路由、执行资源和后端缓存的多级局部性,并给出可复用的路由、失效、故障转移与观测方案。
短文
约 15 分钟阅读
收录于专栏 技术规划与架构 · 第 7 篇
从一套多节点执行系统的故障结构出发,复盘请求、状态、存储、性能和故障如何逐渐跨越边界,并讨论下一版架构应该怎样重新组织。
短文
约 30 分钟阅读
收录于专栏 技术规划与架构 · 第 6 篇
从分析、经营和工程的不同问题出发,整理一个多来源业务平台的数据中心应该如何划分 Tab、定义指标、组织读写链路,以及怎样处理计费、对账、增长和成本。
短文
约 37 分钟阅读
从裂变奖励和交易系统出发,设计一套可复用、可审计的营销基础设施,覆盖活动、受众、权益、预算、归因、风控、实验、触达和效果分析。
案例
约 21 分钟阅读
从一次多系统对接经历出发,区分创造、任务效率、组织生产力和经营价值,讨论 AI 进入复杂系统后,收益到底从哪里来、成本又该怎么算。
短文
约 9 分钟阅读
收录于专栏 工程与 AI 判断 · 第 10 篇
从 ChatLab 的实际设计出发,记录如何借用人和人协作中的在场、回应、等待和交付语法,让 Agent 的运行状态更容易被理解;这是一篇关于反馈、证据、关键介入和结果确认的 HCI 设计观察。
约 26 分钟阅读
阅读摘要多地区系统既不能把所有差异硬塞进一个核心,也不能让每个地区重复建设。关键是识别稳定边界、保留扩展点,并明确模块所有权。
短文
约 4 分钟阅读
收录于专栏 技术规划与架构 · 第 4 篇