产品路线图
本页集中列出 codingas.com 已规划但当前版本尚未实现的能力。下列内容均处于设计或规划阶段,不代表最终交付承诺与时间表。已实现能力请参阅各功能文档。
若某项能力对你至关重要,欢迎通过 联系我们 反馈,帮助调整优先级。
基于向量相似度匹配相似请求并返回缓存结果,目标降低成本 30%+。
- 请求向量化后在缓存库按余弦相似度检索,命中则直接返回缓存响应
- 设计参数:相似度阈值 0.95(可配置 0.80–0.99)、TTL 1 小时、容量 10000 条、向量维度 1536
- 依赖 PostgreSQL + pgvector 0.5+ 与 Embedding 模型
当前状态:设计规格阶段,源码尚未实现,未引入 pgvector 依赖。
MCP 协议
Section titled “MCP 协议”为模型提供标准化上下文与工具接入,支持 Claude / Cursor / Dify 等 MCP 客户端。
- Resources:提供上下文数据(可用模型列表、用量统计)
- Prompts:提供预定义提示模板
- Tools:提供可调用工具函数(查询 Provider 健康、估算 Token)
设计端点:/mcp/v1/resources、/mcp/v1/prompts、/mcp/v1/tools。
当前状态:设计端点阶段,源码尚未实现。
Provider 出站流量经 HTTP/S 或 SOCKS5 代理,满足合规与网络隔离需求。
当前状态:规划中,尚未实现。
可观测性增强
Section titled “可观测性增强”- Grafana 预置仪表盘(延迟 / QPS / Token / 费用)
- Jaeger 分布式追踪
当前状态:已暴露 Prometheus 指标与 OpenTelemetry Trace,Grafana 仪表盘与 Jaeger 集成为规划项。
- 用户 × 渠道限额、请求次数配额
- 国密算法(SM2/SM3/SM4)、完整审计链(WORM)
- 企业 OAuth(飞书、钉钉、GitHub Enterprise)
未实现的调用端点
Section titled “未实现的调用端点”下列端点在设计文档中出现,但当前版本尚未实现:
| 端点 | 说明 |
|---|---|
/v1/completions | Legacy 文本补全 |
/v1/embeddings | 向量嵌入 |
/v1/images/generations /edits /variations | 图像生成 / 编辑 / 变体 |
/v1/audio/speech | 语音合成(TTS) |
/v1/audio/transcriptions /translations | 语音识别 / 翻译 |
/v1/moderations | 内容审核 |
/v1/models/{model} | 模型详情 |
当前已实现的调用端点仅:/v1/chat/completions、/anthropic/v1/messages、/v1/models。详见 API 参考。
规划中的路由能力
Section titled “规划中的路由能力”- 模型级智能降级:额度不足或模型不可用时自动切换备选模型(L2 降级层曾实现后删除,待重新设计)
- 场景路由:按 CODE / CREATIVE / SUMMARY 等场景选路
- 模型别名映射:一个别名指向多个实际模型
- 成本 / 延迟优化策略:
COST_OPTIMIZED、LATENCY_OPTIMIZED路由策略
当前实现:路由策略硬编码为
WEIGHTED(加权),详见 路由设计。
规划中的安全能力
Section titled “规划中的安全能力”- PII 脱敏执行接入:脱敏规则已定义,但尚未接入请求链路(配后暂不生效)
- IP 白名单、UA 过滤、内容审核、Prompt 注入防护
当前实现:IP 黑名单(经控制台配置)、密钥 AES-256-GCM 加密存储、审计日志。详见 安全与风控。
规划中的集成
Section titled “规划中的集成”- 官方 SDK(v2.0 规划):当前通过 OpenAI / Anthropic 官方 SDK 兼容接入,详见 SDK 与集成
- LangChain4j 集成:当前未引入该依赖
规划中的认证
Section titled “规划中的认证”- OAuth 登录:GitHub / Gitee / QQ / 企业微信
当前实现:用户名密码登录(Sa-Token 会话)+ 调用方 API Key 鉴权。详见 用户与认证。
配额扣减接入
Section titled “配额扣减接入”Token 配额的管理 API 已实现(可设置限额),但配额扣减尚未接入请求链路,设置后暂不生效。详见 Token 计量与配额。