产品动态
更新时间 2026-08-24 00:00:00
最近更新时间: 2026-08-24 00:00:00
2026年8月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/08/24 | 限额管理上线 | 新增限额管理能力,支持主账号针对自己和其下所有子账号进行全局级别、账号级别和服务组级别的模型调用额度管理(消费限额、Token限额),支持同时配置多种级别下的多条限额规则。 | 无 |
2026/08/24 | 调用监控和用量统计优化 | 用量统计优化用量指标统计和查询时间范围 调用监控调整支持查询的最大时间范围为近31天 | 无 |
2026/08/21 | 编程Token Plan新模型上线与旧模型下线 | 编程Token Plan上线新模型:GLM5.1与DeepSeekV4 Flash-0731。本次升级无需额外开通权限、无需升级套餐,不额外收取费用。 编程Token Plan旧模型下线:2026年10月10日起,原有旧模型GLM5、DeepSeekV3.2将正式下线,届时将停止提供服务,无法继续调用,请及时完成业务迁移。 | |
2026/08/04 | 星辰TokenHub运营服务平台升级至2.0版本 | 本次平台优化升级围绕权益、计费、模型资源、权限管控、计价规则优化调整,具体内容如下:
1.一键开通全模型按量付费:升级后自动开放全站现有及后续新增模型按量计费权限,无需单独订购;支持独立开关单模型调用权限。 2.新增调用管控能力:主账号可限定子账号可用模型范围,同时按服务组设置模型调用额度上限。 3.优化主子账号权限体系:子账号不再具备自主订购、开通模型权限,全部相关操作由主账号统一管控。 4.新增用量统计模块:支持统计各类模型按量计费模式下的调用数据。 5.扩充模型资源池:上线更多类型、多版本大模型,适配多样化业务场景与差异化性能需求。 6.免费推理额度调整:所有试用类模型统一赠送 50 万 Tokens 免费推理额度,额度有效期 14 天。 7.模型调用方式变更:DeepSeek-V3.1、GLM-5、Qwen3.5-397B-A17B、DeepSeek-V3.2(体验版即将下线)调用方式发生变更,为避免影响业务正常运行,请尽快使用高阶版本模型或提前完成当前模型的参数更换。 |
2026年7月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/07/10 | 编程Token Plan支持多种支付方式 | 订购编程Token Plan时可切换至标准收银台,提供更多样、便捷的支付方式选择。
| |
2026/07/10 | 编程Token Plan和Tokens量包余量预警 | 当编程Token Plan或Tokens量包剩余可用额度较低时,系统将通过短信和站内消息发送预警通知,助您及时掌握资产动态。
| 无 |
2026/07/10 | TPM包暂停新购 | 平台即日起暂停“TPM 包”新购。已成功订购且仍在有效期内的TPM包不受影响,可继续正常使用。 | 无 |
2026年6月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/06/26 | API支持Anthropic协议 | API支持Anthropic协议,支持模型DeepSeek-V4-Pro、DeepSeek-V4-Flash、GLM-5.1、GLM-5(正式版)、Kimi-K2.5、Qwen3.5-397B-A17B(正式版)、Qwen3.5-122B-A10B、Qwen3.5-35B-A3B,其他模型陆续支持中。 | 无 |
2026/06/10 | “Token服务”更名为“星辰TokenHub运营服务平台” | “Token服务”更名为“星辰TokenHub运营服务平台”。名称变更不影响现有的产品使用和服务。 |
2026年5月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/05/22 | 编程Token Plan | 编程Token Plan套餐上线,按固定周期付费,支持在主流AI开发工具中畅享热门模型。
| |
2026/05/08 | 模型上新 | DeepSeek-V4-Pro 模型上线,免费体验50万tokens额度,支持按tokens计费。 |
2026年4月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/04/24 | 模型上新 | DeepSeek-V4-Flash 模型上线,免费体验50万tokens额度,支持按tokens计费。 |
2026年3月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/03/31 | 编码套餐上线 | 模型推理服务上线编码套餐,提供 Lite、Pro、Max 的包月/包年套餐,适应不同强度的编程场景。
| |
2026/03/31 | 阶梯计费上线 | 按需计费模式-Tokens 支持根据上下文长度区间进行阶梯计费。 |
2026年2月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/02/17 | 模型上新 | GLM-5、Qwen3.5-397B-A17B模型上线,免费体验2500万tokens额度,支持按tokens计费。 |
2026年1月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2026/01/16 | 缓存推理上线、调用监控优化 | 1. 缓存命中能力上线,降低输入token成本,目前支持DeepSeek-V3.1模型。
2. 调用监控优化,支持细分筛选不同计费类型下的调用量。 |
2025年12月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2025/12/17 | 批量推理上线、调用监控更新 | 1. 批量推理(Batch Inference)功能上线,可通过离线方式进行大规模数据处理。
2. 调用监控支持分推理类型查看监控指标、支持按照服务组导出监控数据、支持按付费类型查看token用量。 | |
2025/12/05 | 模型上新 | 模型推理服务平台DeepSeek-V3.2模型上线,支持按token计费。 |
2025年11月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2025/11/25 | 模型上新 | 模型推理服务平台Qwen3-Coder-480B-A35B-Instruct、Qwen3-235B-A22B-Instruct-2507、Kimi-K2-Instruct模型上线,支持按token计费。 |
2025年10月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2025/10/17 | MCP、闲时推理上线 | MCP聚合优质资源,扩展模型边界,支持体验和部署MCP服务;
DeepSeek-R1、DeepSeek-V3.1等模型推出优惠时段价格,在优惠时段内的请求按优惠价格计费。 |
2025年9月
|
时间节点 |
功能名称 |
功能描述 |
相关文档 |
|---|---|---|---|
2025/09/09 | 模型推理服务上线 | 模型推理服务为大模型训练、推理、应用提供全栈工具链,包含模型体验、模型定制、模型服务、插件服务等模块。预置丰富的基座大模型和数据集,支持国产化等异构算力,提供算子加速与模型加速,极大提升大模型训练推理效率。 |