黔前 TokenHub

黔前 TokenHub

统一调度本地与大厂算力、接入多种大模型;用可编辑的知识图谱 RAG 与向量计算沉淀企业知识;再以员工帐号与智能大屏把能力铺到办公与展厅现场。

算力调度 本地 GPU / 私有集群与大厂云算力统一编排,按任务路由到合适模型与资源池。
知识图谱 RAG 知识节点可添加、编辑、删除;向量化入库与检索,回答可追溯来源。
帐号与大屏 员工帐号与权限体系,搭配智能大屏展示运营指标、问答与知识看板。
混合
本地 + 云端算力
多模型
主流大模型接入
RAG
图谱 + 向量检索
组织
帐号与智能大屏

本地、大厂算力,各种大模型

把分散的算力与模型收成一张可调度的网:敏感任务走本地,弹性峰值走云端,对话与推理按策略选模型。

本地算力接入

对接机房 GPU、边缘节点与私有推理服务,数据与模型权重可留在内网,满足合规与驻留要求。

大厂云算力

按需调度主流云厂商 GPU / 推理配额,高峰扩容、低谷回收,与本地资源池统一计费与监控视图。

多模型路由

接入 DeepSeek、豆包、智谱、通义、开源本地模型等;按延迟、成本、能力标签自动或手动选路。

配额与观测

按组织、项目、员工帐号分配 Token / GPU 额度;调用量、失败率与队列积压一目了然。

策略与熔断

支持优先级队列、超时降级、备用模型切换,避免单点模型故障拖垮业务。

OpenAI 兼容接入

对外提供统一 API 形态,现有业务系统与桌面客户端可少改代码接入 TokenHub 调度层。

可添加、编辑、删除 · 向量计算

不只是「上传文档」,而是把企业知识建成可维护的图谱节点,配合向量检索做可追溯问答。

01

添加知识节点

支持文档、FAQ、制度条款、实体关系等入库;批量导入与人工补录并存。

02

编辑与版本

在线修订节点内容与关系边,保留变更记录,便于审计与回滚。

03

删除与治理

过期或敏感知识可下线删除,配合权限控制避免误删扩散。

04

向量计算

文本切片、Embedding 入库与相似度检索;图谱路径与向量召回可组合增强回答质量。

多源知识接入

对接网盘、Wiki、制度库与业务系统导出;统一分块策略与元数据标签。

混合检索

关键词 + 向量 + 图谱邻域联合召回,再经重排序后交给大模型生成答复。

来源可追溯

回答附带引用节点与原文片段,方便业务人员核对,降低幻觉风险。

员工帐号 · 智能大屏

把算力与知识能力落到人与现场:谁能用、用多少、大屏怎么看,都在同一套体系里。

员工帐号

组织架构、角色权限与单点登录对接;按部门开通模型、知识库与算力配额。

权限与审计

细粒度控制知识库可见范围与管理操作;登录、调用与知识变更可留痕。

智能大屏

展厅 / 指挥中心大屏展示调用热力、知识问答、运营指标与实时告警看板。

场景模板

内置客服问答、制度查询、展厅讲解等模板,开箱后按行业微调即可上线。

通知与工单

额度告警、任务失败通知可推送到管理员;复杂问题可升级人工工单。

多租户扩展

集团 / 子公司隔离配置,共享平台能力的同时保证数据边界清晰。

从试点到组织级落地

政企知识中枢

制度、公文与办事指南入图谱;本地优先推理,云端补充高峰能力。

园区与展厅

智能大屏展示产业数据与 AI 问答,员工帐号支撑讲解与运维值班。

客服与内部问答

RAG 回答可追溯;算力调度保证高峰时段仍可稳定响应。

与黔前智算产品组合使用

TokenHub 负责组织级调度与知识中枢;黔前Ai助手、Ai管家、CodeNeo 可作为端侧入口,词元套餐与 GPU 算力按需叠加。