参考东数西算、中国电信息壤、华为 RAS、DeepLink、Akash、io.net、Gensyn 等国内外分布式算力中心与去中心化算力网络的实践, 我们把智能调度、异构融合、市场化定价、可信验证、绿色低碳五大技术主线,落地为 KOGUN 平台可运行、可扩展的五层架构。 (Distributed AI Compute Platform Architecture)
架构优化不是空中楼阁。下列能力均已存在于 KOGUN 当前代码库(路由与模块经实测核对),是本次架构升级的真实基座,而非规划蓝图。
设备/节点注册 /api/devices/register、心跳 /heartbeat、暂停/恢复、状态查询。支持 NVIDIA / 昇腾 / AMD 及消费级 GPU、CPU 节点即插即用。
已上线scheduler.py 3 个独立协程 + three_tier_scheduler.py 三层模型感知调度(Fluid 数据本地性)。峰值定价、冗余度=3、移动端约束已内置。
已上线/v1/chat|images|audio|embeddings|compute 统一能力出口,将异构算力抽象为标准化 AI 服务,对标"一云多芯"的统一服务面。
已上线/api/marketplace 任务市场 + /api/compute-market 算力市场(含 /prices 动态定价、listings、订单)。供需撮合与按量计费雏形已成。
已上线/api/earnings、提现 /withdraw、管理员提现审核、企业控制台 /enterprise。完整"贡献算力→获得收益"闭环。
已上线/api/community/map 节点地理分布、/api/platform/stats 平台统计、热力图 /heatmap。运营可视化的基础已就绪。
已上线自下而上:接入层 → 智能调度层(算力大脑)→ 异构资源层 → 可信层 → 运营层,由"调度大脑"贯穿全局,并以 绿色低碳、安全可信、弹性快速交付 三大主线贯穿始终。
每一层都对应一项或多项调研所得的前沿技术,并已/将在 KOGUN 代码库中落地。
统一入口屏蔽异构差异。个人/开发者经 /api/auth 登录,算力提供方经 /api/devices 注册并心跳保活,企业经控制台接入,AI Agent/CLI 经 /deploy 自举。 对标:华为 RAS"四化"中的标准化接入。
已上线对标中国电信息壤"AI 调度 AI"的算网大脑。KOGUN 以 scheduler.py 3 协程 + three_tier 模型感知调度(Fluid 数据本地性)实现跨节点编排; 升级:引入多目标优化(算力类型/地理/成本/时延/能效)与强化学习策略,逼近息壤级调度智能。
已上线 + 升级中对标华为 RAS"一云多芯"。通过 /v1/* 多模态网关把 NVIDIA/昇腾/AMD/CPU 与边缘节点抽象为统一算力面, 上层应用无感调用;升级:节点能效(PUE/碳足迹)指标采集,支撑绿色低碳主线。
已上线 + 升级中对标 Gensyn / opML / zkML 的"算力真实性"难题。KOGUN 已有设备认证与信用体系;规划引入 TEE 安全执行 + 零知识结果验证(★), 让"任务是否真的被算、结果是否可信"可被密码学证明,解决去中心化算力的最大信任痛点。
规划升级 ★对标 Akash / io.net 的市场化供给。任务市场 /marketplace 连接需求与算力,算力市场 /compute-market 以 /prices 动态定价撮合供需; 收益中心 /earnings 完成结算闭环,社区地图与看板支撑运营可视化。
已上线贯穿全栈的主线。节点客户端分钟级接入(对标 Render 一键部署),任务即传即算(Serverless), 跨域资源随取随用——把"重资产、长周期"的集中式智算中心,重构为"轻资产、即插即用"的分布式供给。
已上线把国内外分布式算力中心与去中心化算力网络的关键技术,逐一映射到 KOGUN 平台的现状与升级方向,避免"为调研而调研"。
| 技术方向 | 调研标杆 / 来源 | KOGUN 现状 | 架构升级方向 |
|---|---|---|---|
| 智能调度 算网大脑 | 中国电信息壤(AI 调度 AI,2+3+7+X) | 3 协程调度器 + 三层模型感知调度 + 峰值定价 | 多目标优化 + 强化学习调度策略,逼近息壤级智能 |
| 异构融合 一云多芯 | 华为 RAS(PUE 1.12,四化策略) | /v1 多模态网关统一 NVIDIA/昇腾/AMD | 统一算力抽象 + 节点能效(PUE/碳足迹)采集 |
| 跨域协同 混训 | DeepLink 跨域混训(利用率 >90%) | 任务 accept/claim 单机执行 | 任务切分至多节点并行协同,提升整体利用率 |
| 市场化供给 动态定价 | Akash(便宜 60–70%)、io.net、Render | 任务市场 + 算力市场 + /prices 动态定价 | 供需实时定价优化 + 信誉加权撮合 |
| 可信验证 结果证明 | Gensyn(密码学验证)、TEE / zkML / opML | 设备认证 + 信用积分(无结果验证) | ★ TEE + 零知识结果验证,密码学证明算力真实性 |
| 绿色低碳 东数西算 | 东数西算(8 枢纽 / 20ms 时延圈 / 绿电) | 节点地理分布 + 社区热力图 | 绿电/碳足迹看板 + 低碳调度偏好(就近绿电节点) |
| 高速互联 低时延 | RDMA / CPO / 液冷(行业趋势) | HTTP 心跳 + 任务下发 | 节点间高速通道规范(可选 RDMA)、结果增量同步 |
综合现状与升级方向,KOGUN v2 将具备以下端到端能力。
参考调研,我们将下列主线作为架构演进的北极星。
复用闲置硬件与绿电边际能耗更低。架构升级引入节点 PUE/碳足迹指标,并在调度中偏好就近绿电节点,呼应东数西算"上架即绿"理念。
对标 Gensyn / opML / zkML,规划引入 TEE 安全执行环境与零知识结果验证,使"算力被真实消耗、结果可被证明"成为平台内建能力,破解去中心化算力的信任难题。
对标 DeepLink 跨域混训,将单机任务执行升级为跨节点任务切分与协同,提升全局算力利用率(目标 >90%),并向"算力网络"演进。
KOGUN 的主线目标是:让任何闲置电脑都能"挂靠即赚"。从客户端一键挂靠到收益提现,形成完整、可信、可结算的闭环——这也是本次调研(Salad / BOINC / Akash / io.net 等)直接沉淀的架构主线。
下载轻量客户端,一行命令安装,自动识别硬件与位置,3 分钟接入,零加密门槛。
/api/devices/register 上报 GPU/CPU 型号、显存、带宽,平台自动评级定级。
/heartbeat 周期上报健康与在线时长,支撑节点健康分与分层激励。
调度大脑按算力 / 网络 / 在线时长匹配,闲置即派单,就近低时延。
任务在隔离沙箱运行,数据加密、任务后自动清理,平台不强制占用设备。
冗余计算 + 哈希校验 + 验证采样,结合声誉积分识别虚假算力。
按卡时 / 在线时长计量,/api/earnings 实时入账,动态定价锚定真实用量。
/api/earnings/withdraw 提现,VIP 双倍收益、邀请返佣、公益捐赠。
当任务在第 ⑦ 步完成结算时,/api/earnings 将收益按 客户 70%、平台 25%、公益 5% 自动切分入账——客户实时到账,平台反哺基建,公益持续流向社会。
实时入账至贡献者账户,可经 /withdraw 提现,VIP 享收益加成。
沉淀为平台研发与算力网络基建,反哺调度与可信执行能力。
自动进入公益池,由管理员经 /api/admin/charity/allocate 分配至教育 / 科研项目。
本次调研的 GitHub 开源方案,已逐一映射为 KOGUN 架构的增强点。详细开源清单见《分布式算力中心》专题的"GitHub 开源方案技术调研"章节。
客户端注册 + 心跳 + 任务分片,成熟范式直接落地设备接入与保活,零加密门槛。
任务图与 Actor 模型,强化调度大脑的大规模编排、弹性伸缩与故障自动重分配。
消费级设备组集群推理,与 vLLM 端点结合切分大模型子任务,家用 GPU 即集群。
反向拍卖 + 节点健康分层奖励,算力市场动态定价撮合供需、锚定真实用量。
可验证计算与密码学证明,规划引入结果验证闭环,破解"算得对不对"。
复用闲置硬件、就近绿电节点,边际能耗远低于新建机房,闲置即减碳。
本页是 KOGUN 平台自身架构;行业调研(东数西算、息壤、华为 RAS、Akash、Gensyn 等)详见《分布式算力中心》专题,两者互为表里。