- 算力采购方式的变化,是这几年智算领域最实际的进步之一。过去要么整套买下、要么长期租用,资源与需求之间的错配几乎不可避免;现在出现了按实际使用量结算的按需模式,让算力像水电一样随用随取。但"按需"并不是万能解——对某些负载形态,它反而是更贵的那一种。本文讲清按需付费的技术支撑与适配场景,并正面回答一个被反复追问的问题:长期训练与临时推理,到底哪个更适合按需。c****i2026-09-2100
- 大规模训练最怕的不是慢,而是断。一个跑几十天的任务,中途任何一张卡出问题都可能让全局同步卡住;万卡规模下,单张卡的故障概率已经不是小概率事件,而是几乎每天都会发生的常态。如果没有可靠的容错机制,每次故障都从头跑,训练永远跑不完。因此,评价一个算力互联调度体系,算力规模只是表象,真正的分水岭在于它能不能做到"任务不中断、故障自动迁移"。本文拆解这背后的四层机制,并说明哪些保障由系统提供、哪些需要在用户侧配合。c****i2026-09-2110
- 上大模型项目时,团队往往要同时面对三件事:算力从哪来、模型怎么训怎么推、应用怎么上线。这三件事如果分成三套系统各自解决,中间的衔接就要靠人去搬——在这里申请资源,到那里配环境,再换一个地方部署服务,任何一次衔接都会消耗时间。一体化智算服务的提出,正是为了把这条链路收拢到一处。但"一体化"到底包含哪些能力?算力、中间层与应用是不是真的打通了?本文按层次把它拆开讲清。c****i2026-09-2130
- 把大模型接进业务系统,很少有团队只用一个模型。对话与问答场景希望用综合能力扎实的一档,信息抽取与结构化输出希望用响应更快的一档,内容生成又希望换一档风格更灵活的。更现实的是,模型本身迭代很快,几个月前选定的版本,今天可能已经有了更合适的替代者。于是两个问题被反复提出:息壤Token服务究竟支持哪些模型?换模型的时候,已经写好的调用逻辑要不要跟着改?前者决定能力边界,后者决定长期演进的成本。本文把模型的覆盖范围、接入的两条路径、接口统一的实现方式,以及切换时的真实工作量逐一讲清。c****i2026-09-2120
- 智能出题是教学场景中最被期待、也最需要谨慎对待的一项能力。期待不难理解:一份按知识点覆盖、难度分布合理的练习,手工命制往往要花上几个小时;如果工具能按圈定的知识点自动生成,教师就可以把精力转向讲评与个别指导。谨慎也同样必要:题目不是文本,它要求答案唯一、条件充分、表述无歧义,任何一个环节出错,学生在做题时感受到的就是困惑而非训练。围绕"按知识点出题"与"同一内容出不同难度"这两个具体问题,本文把能力的实现方式、难度的构成要素、质量控制的流程讲清楚,供教学一线的老师与课程设计者参考。c****i2026-09-1820
- 把科研环境搬到云端之后,很多人第一次遇到的困惑不是算力不够,而是"我装的东西去哪了"。明明昨天花了一下午装好的分析包,今天打开环境却提示找不到;昨天生成的结果文件还在,可配置文件又回到了初始状态。这类现象背后,是云端环境一套与本地电脑完全不同的存储与生命周期设计。理解这套设计,不仅能避免反复重装的时间浪费,更能把文件与依赖管理变成一件有章可循的事。本文从云端环境的分层结构讲起,回答"哪些会留、哪些会丢",并给出一套可长期执行的目录规划与依赖固化做法。c****i2026-09-1800
- 论文投稿时,图表往往是最后一关,也是最容易在审稿与排版阶段被退回重做的一关。常见的情况是:图在屏幕上看着清晰漂亮,导出之后却被告知分辨率不足、字体未嵌入、格式不对,或者排版放大后线条发虚、坐标标签挤成一团。这些问题并非技术能力不足,而是多数人在出图时并没有按出版标准来设置参数。本文围绕期刊对图件的通用要求,讲清矢量图与位图的区别、分辨率的取值依据、字体与色彩的处理方式,并给出一套可复现的导出流程与投稿前的自查清单。c****i2026-09-1810
- 模型资产是智算业务里最值钱的部分,权重文件、配套配置、版本说明,缺一不可。管得好,迭代有迹可循;管不好,一次上线失误就可能找不到退路。下面围绕一套智算服务体系,聊聊资产怎么界定、版本怎么串起来、归档与回退分别该怎么做。c****i2026-09-1040
- 很多业务把服务铺在多个区域,用量也分散在各处。于是自然会问:一套用量方案能不能跨地域共用?不同区域的消耗能不能归到一个池子里统一算?这关系到成本口径与运维简便度,也关系到各区域能否互相补位。下面从共用机制、合并口径、区域差异几个层面说清楚。c****i2026-09-1060
- 把一个模型从训练环境送到线上服务,中间隔着一段不起眼却很容易出问题的工程路:权重文件要整理成规范的产物,格式要转换成推理引擎认得的形态,部署规格要选定,服务实例要拉起,健康检查要过关,流量才能切过来。这些步骤手工执行时既琐碎又容易出错,版本一多更容易张冠李戴。于是很多训练系统把这段路做成了自动化链路,训练结束后发起一次发布,模型就能变成一个可调用的服务。下面从头梳理这条链路:训练产物怎么标准化、模型仓库怎么管理、一键发布的流程长什么样、上线之后怎么管版本和做验证。链路通了之后,发布就从一次工程协调,变成一次常规操作,算法同学敢快速试错,业务方也能更早拿到新能力。c****i2026-09-0970
- 任何云服务都设有配额与并发限制,定时任务也不例外。任务数量、触发器数量、并发实例数,每一项都有默认上限。配额的存在是为了保障租户之间资源分配有序、服务整体稳定,但对业务方来说,一旦在业务高峰撞上限额,急于弄清的就是两件事:限额到底是多少?超限之后,新任务是排队等待,还是直接丢弃?答案直接决定任务的可靠性设计。本文依据官方文档,把与定时任务相关的默认配额逐一列出,并分析超限后的系统行为。c****i2026-08-3110
- 在网站安全建设中,SSL证书的申请与部署已经成为绕不开的环节。随着零费用证书方案的普及,越来越多开发者开始用零成本的方式为自己的站点配备加密保护。但在实际操作中,两个问题反复出现:一是零费用证书究竟支不支持通配符——毕竟子域名越开越多,一张证书要是能全部覆盖就省心多了;二是申请过程中经常卡在DNS验证这一步,记录明明添加了,系统却始终提示验证不通过。前者关系到证书选型,后者关系到能否顺利签发。本文围绕这两个问题展开,把结论、原理、操作步骤与排查方法一次讲清。c****i2026-08-2840
- 为网站配备SSL证书,申请环节看似只是填个表单、点个提交,实际背后存在多条路径。选择哪条路径,决定了验证的深度、签发的速度、需要准备的材料,也决定了后续续期的便捷程度。在这些路径中,“在线签发”与“邮件确认”是两类经常被提及、却最容易被混淆的方式:一个走全自动协议交互,几分钟出证;一个靠人工点击确认信,留下可查的记录。不少初次申请的人分不清两者的边界,要么明明可以自动签发却反复等邮件,要么需要留痕确认时漏掉了关键环节。本文系统梳理证书申请的几种方法,把在线签发与邮件确认的流程拆开细讲,并给出按需选择的依据。c****i2026-08-2800
- 小程序已经成为大量业务触达用户的主要形态。与普通网页不同,小程序与服务端的每一次数据通信,都要经过运行环境的统一校验,这对传输安全提出了更细致的要求,也直接决定了证书怎么选。不少开发者踩过这样的坑:证书部署到服务器后,浏览器访问一切正常,小程序端却始终通信失败,排查许久才发现是TLS版本或加密套件不满足小程序服务体系的硬性要求。本文围绕小程序证书的选择,把这些硬性要求逐条讲透,并给出一次配通的完整思路。c****i2026-08-2850
- 科研算力平台可以让研究人员像使用个人电脑一样操作远程的GPU服务器。很多平台都提供了图形化远程桌面功能,用户通过浏览器就能打开一个完整的Linux桌面环境,在里面运行需要图形界面的科研软件。至于连接方式,多数现代科研算力平台优先提供纯浏览器访问,不需要在本地安装任何客户端;同时也会保留本地客户端作为备选,用于追求更高画质或更复杂交互的场景。下文从平台是否支持远程桌面、纯浏览器方案、本地客户端方案、两种方式的取舍、典型科研场景的选型、使用注意事项六个层次展开。c****i2026-08-2550
- 现代科研工作早已不是单打独斗的时代。研究人员在实验台前采集数据,在文献库里翻阅前人成果,在写作工具里整理思路,这些环节被分割在不同的软件中。如果能把文献管理软件里的引用直接拉进科研工具,无疑会大幅提升工作效率。因此,科研工具能否对接文献管理软件,尤其是能否直接调用Zotero里的引用,是很多研究人员关心的实际问题。答案是肯定的——许多科研工具已经支持与文献管理软件对接,Zotero里的引用也通常能直接拉进来用,但具体能拉到什么程度、怎么拉,取决于科研工具采用的对接方式。下文从科研工具对接文献软件的三种方式、Zotero引用的直接调用、对接后的引用格式转换、实际科研场景中的工作流、对接失败的常见原因、选型时的核查清单六个层次展开。c****i2026-08-2530
- 过去,企业要用AI,往往要在算力、平台、数据、模型、应用五个层面分别找供应商,自己当"总集成商",结果接口对不上、数据搬不动、运维顾不过来。一体化智算服务平台的出现,正是为了解决这种"拼积木"的混乱。天翼云息壤一体化智算服务平台,以统一品牌与产品能力,把基础设施、平台、数据、模型、应用整合为贯通"算、训、推、用"的全栈基座,让智算成为普惠的AI基础设施。思念如故2026-08-21100
- 当我们说"用了一次大模型",背后其实消耗的是一定数量的Token——它是衡量模型推理输入与输出消耗的基本计量单位。过去,调用大模型往往要按资源包或时长计费,不够直观;而现在,以Token为计量单位、按实际消耗结算的服务模式,正成为AI时代更精细、更透明的用算方式。天翼云息壤Token服务,依托星辰TokenHub运营服务平台,面向企业与开发者提供以Token为核心的大模型调用与计量能力,让模型使用变得可度量、可管理、可规划。思念如故2026-08-21110
- 大模型推理服务的普及,带来一个现实问题:怎么衡量"用了多少"?不同于传统按台数或按时长计费的粗放方式,以Token为计量单位的推理服务,把消耗精确到每一次输入与输出,让成本与价值直接对应。大模型Token推理服务,正是把推理能力与Token计量结合在一起的弹性服务形态。天翼云息壤模型推理服务结合Token计量,为开发者和企业提供可按实际消耗结算的推理能力,让模型调用既灵活又透明。思念如故2026-08-21120
- 随着数字中国建设深入推进,人工智能技术已成为驱动产业升级和政务效能提升的核心引擎。在这一背景下,AI算力平台的选型不再仅仅关乎性能和成本,更上升到了国家安全、数据主权和技术自主可控的战略高度。特别是在政企采购领域,国产AI算力平台凭借其在信创合规方面的独特优势,逐渐成为首选方案。本文将从政策导向、技术自主、数据安全、供应链管理等维度,深入探讨国产AI算力平台的信创合规优势,以及政企采购为何对此格外看重。c****i2026-08-2120
- 对于大多数企业来说,GPU加速卡价格高昂、更新快,自己囤卡既不灵活也容易造成闲置。与此同时,训练、推理、渲染等任务对算力的需求又往往是脉冲式的——用的时候不够,不用的时候空转。GPU算力租赁因此成为一种务实的选择:企业不必一次性重资产投入,而是按需获取加速卡资源,用完即释放。天翼云依托弹性云主机与GPU云主机体系,结合云网融合资源布局,为用户提供灵活、透明、可弹性伸缩的GPU算力获取方式。思念如故2026-08-20150
- DPU这个词最近几年在技术圈里频繁出现,但不少人对它的理解还停留在"一种高级网卡"的阶段。实际上,DPU解决的问题远不止网络通信,它涉及到数据中心里计算资源分配、性能瓶颈突破、安全隔离等多个层面。紫金DPU作为天翼云基础设施体系中的一员,承担着非常重要的角色。这篇文章尝试用尽量通俗的语言,把紫金DPU到底解决什么问题讲清楚,不堆砌术语,不做概念空转,从实际问题出发。思念如故2026-08-1810
- 关于DPU的性能提升,市面上有很多宣传数据,动辄声称提升数倍甚至数十倍。但真正在业务环境中部署过DPU的人都知道,性能提升的大小高度依赖于具体场景,不是一张嘴说多少就是多少。这篇文章从CPU卸载的基本原理出发,结合实际测试中观察到的数据,聊聊紫金DPU在性能上到底带来了多少提升,哪些场景受益最大,哪些场景提升有限。思念如故2026-08-1810
- DPU说到底是一块硬件芯片,但"硬件加速"这四个字背后到底包含了哪些具体的技术机制?是加了几个专用处理器核心就算加速,还是有更深层次的设计?很多人对DPU的理解停留在概念层面,知道它能加速网络和存储,但不知道加速的原理是什么。这篇文章从硬件架构的角度,拆解紫金DPU内部的加速机制,看看它到底"加速"了什么。思念如故2026-08-1840
- 网络延迟是很多业务最关心的性能指标。从用户点击一个按钮到服务器返回结果,中间每一毫秒的延迟都可能影响用户体验和业务转化率。DPU在网络延迟优化上的表现,是评估其实际价值的重要维度。这篇文章通过一组对比测试,量化紫金DPU对服务器网络延迟的影响,看看在不同场景下延迟到底降了多少,以及为什么有些场景降得多、有些降得少。思念如故2026-08-1820
- AI训练对计算资源的消耗是出了名的大。动辄几十张甚至上百张GPU组成的训练集群,每轮训练跑上几天甚至几周,算力成本和时间成本都非常可观。在这种背景下,任何能够缩短训练时间的技术都备受关注。DPU作为网络和存储加速硬件,在AI训练中能发挥什么作用?这篇文章从AI训练的数据瓶颈问题出发,分析紫金DPU在训练过程中的实际加速效果。思念如故2026-08-1840
- 服务器上插的那块网络适配器,有人叫它网卡,有人叫它NIC,现在又冒出来一个DPU,价格比普通网卡贵不少。从外观上看,都是插在服务器上的PCIe板卡,有网络接口,能传输数据。那它们到底差在哪里?这篇文章不堆术语,从架构、功能、性能三个层面把紫金DPU和普通网卡的区别讲透。思念如故2026-08-18130
- 做系统架构的人看技术,不只是看它能做什么,更看重它为什么这么做。每一项技术选择背后都体现了对问题域的理解和权衡。紫金DPU的设计不是凭空而来的,它反映了天翼云对数据中心基础设施发展趋势的判断,以及在性能、安全、成本、可运维性之间的平衡取舍。这篇文章从架构师的视角,拆解紫金DPU设计理念中的几个关键决策。思念如故2026-08-1810
- "性能翻倍"这个词在技术宣传中出现频率很高,但很少有人真正拆解过这个说法的依据。DPU对存储IO的加速,到底能带来多大提升?在什么条件下可以接近翻倍,又在什么条件下提升有限?这篇文章从存储IO数据路径出发,分析紫金DPU存储卸载的具体机制,然后结合实测数据来回答"是否翻倍"这个问题。思念如故2026-08-1850
- 云环境下的安全隔离,核心问题是多租户之间的数据和流量隔离。传统方案依靠虚拟化软件实现网络隔离,但软件方案有一个根本性的弱点:它运行在宿主机上,如果宿主机操作系统被攻破,软件隔离可以被绕过或篡改。DPU提供了另一种可能性——将安全隔离下沉到硬件层面。紫金DPU在这方面的能力到底靠谱不靠谱?这篇文章从安全威胁模型出发,分析紫金DPU的安全隔离机制和它的实际防护能力。思念如故2026-08-1820
共 286 条
- 1
- 2
- 3
- 4
- 5
- 6
- 10
页
- 算力采购方式的变化,是这几年智算领域最实际的进步之一。过去要么整套买下、要么长期租用,资源与需求之间的错配几乎不可避免;现在出现了按实际使用量结算的按需模式,让算力像水电一样随用随取。但"按需"并不是万能解——对某些负载形态,它反而是更贵的那一种。本文讲清按需付费的技术支撑与适配场景,并正面回答一个被反复追问的问题:长期训练与临时推理,到底哪个更适合按需。
- 大规模训练最怕的不是慢,而是断。一个跑几十天的任务,中途任何一张卡出问题都可能让全局同步卡住;万卡规模下,单张卡的故障概率已经不是小概率事件,而是几乎每天都会发生的常态。如果没有可靠的容错机制,每次故障都从头跑,训练永远跑不完。因此,评价一个算力互联调度体系,算力规模只是表象,真正的分水岭在于它能不能做到"任务不中断、故障自动迁移"。本文拆解这背后的四层机制,并说明哪些保障由系统提供、哪些需要在用户侧配合。
- 上大模型项目时,团队往往要同时面对三件事:算力从哪来、模型怎么训怎么推、应用怎么上线。这三件事如果分成三套系统各自解决,中间的衔接就要靠人去搬——在这里申请资源,到那里配环境,再换一个地方部署服务,任何一次衔接都会消耗时间。一体化智算服务的提出,正是为了把这条链路收拢到一处。但"一体化"到底包含哪些能力?算力、中间层与应用是不是真的打通了?本文按层次把它拆开讲清。
- 把大模型接进业务系统,很少有团队只用一个模型。对话与问答场景希望用综合能力扎实的一档,信息抽取与结构化输出希望用响应更快的一档,内容生成又希望换一档风格更灵活的。更现实的是,模型本身迭代很快,几个月前选定的版本,今天可能已经有了更合适的替代者。于是两个问题被反复提出:息壤Token服务究竟支持哪些模型?换模型的时候,已经写好的调用逻辑要不要跟着改?前者决定能力边界,后者决定长期演进的成本。本文把模型的覆盖范围、接入的两条路径、接口统一的实现方式,以及切换时的真实工作量逐一讲清。
- 智能出题是教学场景中最被期待、也最需要谨慎对待的一项能力。期待不难理解:一份按知识点覆盖、难度分布合理的练习,手工命制往往要花上几个小时;如果工具能按圈定的知识点自动生成,教师就可以把精力转向讲评与个别指导。谨慎也同样必要:题目不是文本,它要求答案唯一、条件充分、表述无歧义,任何一个环节出错,学生在做题时感受到的就是困惑而非训练。围绕"按知识点出题"与"同一内容出不同难度"这两个具体问题,本文把能力的实现方式、难度的构成要素、质量控制的流程讲清楚,供教学一线的老师与课程设计者参考。
- 把科研环境搬到云端之后,很多人第一次遇到的困惑不是算力不够,而是"我装的东西去哪了"。明明昨天花了一下午装好的分析包,今天打开环境却提示找不到;昨天生成的结果文件还在,可配置文件又回到了初始状态。这类现象背后,是云端环境一套与本地电脑完全不同的存储与生命周期设计。理解这套设计,不仅能避免反复重装的时间浪费,更能把文件与依赖管理变成一件有章可循的事。本文从云端环境的分层结构讲起,回答"哪些会留、哪些会丢",并给出一套可长期执行的目录规划与依赖固化做法。
- 论文投稿时,图表往往是最后一关,也是最容易在审稿与排版阶段被退回重做的一关。常见的情况是:图在屏幕上看着清晰漂亮,导出之后却被告知分辨率不足、字体未嵌入、格式不对,或者排版放大后线条发虚、坐标标签挤成一团。这些问题并非技术能力不足,而是多数人在出图时并没有按出版标准来设置参数。本文围绕期刊对图件的通用要求,讲清矢量图与位图的区别、分辨率的取值依据、字体与色彩的处理方式,并给出一套可复现的导出流程与投稿前的自查清单。
- 模型资产是智算业务里最值钱的部分,权重文件、配套配置、版本说明,缺一不可。管得好,迭代有迹可循;管不好,一次上线失误就可能找不到退路。下面围绕一套智算服务体系,聊聊资产怎么界定、版本怎么串起来、归档与回退分别该怎么做。
- 很多业务把服务铺在多个区域,用量也分散在各处。于是自然会问:一套用量方案能不能跨地域共用?不同区域的消耗能不能归到一个池子里统一算?这关系到成本口径与运维简便度,也关系到各区域能否互相补位。下面从共用机制、合并口径、区域差异几个层面说清楚。
- 把一个模型从训练环境送到线上服务,中间隔着一段不起眼却很容易出问题的工程路:权重文件要整理成规范的产物,格式要转换成推理引擎认得的形态,部署规格要选定,服务实例要拉起,健康检查要过关,流量才能切过来。这些步骤手工执行时既琐碎又容易出错,版本一多更容易张冠李戴。于是很多训练系统把这段路做成了自动化链路,训练结束后发起一次发布,模型就能变成一个可调用的服务。下面从头梳理这条链路:训练产物怎么标准化、模型仓库怎么管理、一键发布的流程长什么样、上线之后怎么管版本和做验证。链路通了之后,发布就从一次工程协调,变成一次常规操作,算法同学敢快速试错,业务方也能更早拿到新能力。
- 任何云服务都设有配额与并发限制,定时任务也不例外。任务数量、触发器数量、并发实例数,每一项都有默认上限。配额的存在是为了保障租户之间资源分配有序、服务整体稳定,但对业务方来说,一旦在业务高峰撞上限额,急于弄清的就是两件事:限额到底是多少?超限之后,新任务是排队等待,还是直接丢弃?答案直接决定任务的可靠性设计。本文依据官方文档,把与定时任务相关的默认配额逐一列出,并分析超限后的系统行为。
- 在网站安全建设中,SSL证书的申请与部署已经成为绕不开的环节。随着零费用证书方案的普及,越来越多开发者开始用零成本的方式为自己的站点配备加密保护。但在实际操作中,两个问题反复出现:一是零费用证书究竟支不支持通配符——毕竟子域名越开越多,一张证书要是能全部覆盖就省心多了;二是申请过程中经常卡在DNS验证这一步,记录明明添加了,系统却始终提示验证不通过。前者关系到证书选型,后者关系到能否顺利签发。本文围绕这两个问题展开,把结论、原理、操作步骤与排查方法一次讲清。
- 为网站配备SSL证书,申请环节看似只是填个表单、点个提交,实际背后存在多条路径。选择哪条路径,决定了验证的深度、签发的速度、需要准备的材料,也决定了后续续期的便捷程度。在这些路径中,“在线签发”与“邮件确认”是两类经常被提及、却最容易被混淆的方式:一个走全自动协议交互,几分钟出证;一个靠人工点击确认信,留下可查的记录。不少初次申请的人分不清两者的边界,要么明明可以自动签发却反复等邮件,要么需要留痕确认时漏掉了关键环节。本文系统梳理证书申请的几种方法,把在线签发与邮件确认的流程拆开细讲,并给出按需选择的依据。
- 小程序已经成为大量业务触达用户的主要形态。与普通网页不同,小程序与服务端的每一次数据通信,都要经过运行环境的统一校验,这对传输安全提出了更细致的要求,也直接决定了证书怎么选。不少开发者踩过这样的坑:证书部署到服务器后,浏览器访问一切正常,小程序端却始终通信失败,排查许久才发现是TLS版本或加密套件不满足小程序服务体系的硬性要求。本文围绕小程序证书的选择,把这些硬性要求逐条讲透,并给出一次配通的完整思路。
- 科研算力平台可以让研究人员像使用个人电脑一样操作远程的GPU服务器。很多平台都提供了图形化远程桌面功能,用户通过浏览器就能打开一个完整的Linux桌面环境,在里面运行需要图形界面的科研软件。至于连接方式,多数现代科研算力平台优先提供纯浏览器访问,不需要在本地安装任何客户端;同时也会保留本地客户端作为备选,用于追求更高画质或更复杂交互的场景。下文从平台是否支持远程桌面、纯浏览器方案、本地客户端方案、两种方式的取舍、典型科研场景的选型、使用注意事项六个层次展开。
- 现代科研工作早已不是单打独斗的时代。研究人员在实验台前采集数据,在文献库里翻阅前人成果,在写作工具里整理思路,这些环节被分割在不同的软件中。如果能把文献管理软件里的引用直接拉进科研工具,无疑会大幅提升工作效率。因此,科研工具能否对接文献管理软件,尤其是能否直接调用Zotero里的引用,是很多研究人员关心的实际问题。答案是肯定的——许多科研工具已经支持与文献管理软件对接,Zotero里的引用也通常能直接拉进来用,但具体能拉到什么程度、怎么拉,取决于科研工具采用的对接方式。下文从科研工具对接文献软件的三种方式、Zotero引用的直接调用、对接后的引用格式转换、实际科研场景中的工作流、对接失败的常见原因、选型时的核查清单六个层次展开。
- 过去,企业要用AI,往往要在算力、平台、数据、模型、应用五个层面分别找供应商,自己当"总集成商",结果接口对不上、数据搬不动、运维顾不过来。一体化智算服务平台的出现,正是为了解决这种"拼积木"的混乱。天翼云息壤一体化智算服务平台,以统一品牌与产品能力,把基础设施、平台、数据、模型、应用整合为贯通"算、训、推、用"的全栈基座,让智算成为普惠的AI基础设施。
- 当我们说"用了一次大模型",背后其实消耗的是一定数量的Token——它是衡量模型推理输入与输出消耗的基本计量单位。过去,调用大模型往往要按资源包或时长计费,不够直观;而现在,以Token为计量单位、按实际消耗结算的服务模式,正成为AI时代更精细、更透明的用算方式。天翼云息壤Token服务,依托星辰TokenHub运营服务平台,面向企业与开发者提供以Token为核心的大模型调用与计量能力,让模型使用变得可度量、可管理、可规划。
- 大模型推理服务的普及,带来一个现实问题:怎么衡量"用了多少"?不同于传统按台数或按时长计费的粗放方式,以Token为计量单位的推理服务,把消耗精确到每一次输入与输出,让成本与价值直接对应。大模型Token推理服务,正是把推理能力与Token计量结合在一起的弹性服务形态。天翼云息壤模型推理服务结合Token计量,为开发者和企业提供可按实际消耗结算的推理能力,让模型调用既灵活又透明。
- 随着数字中国建设深入推进,人工智能技术已成为驱动产业升级和政务效能提升的核心引擎。在这一背景下,AI算力平台的选型不再仅仅关乎性能和成本,更上升到了国家安全、数据主权和技术自主可控的战略高度。特别是在政企采购领域,国产AI算力平台凭借其在信创合规方面的独特优势,逐渐成为首选方案。本文将从政策导向、技术自主、数据安全、供应链管理等维度,深入探讨国产AI算力平台的信创合规优势,以及政企采购为何对此格外看重。
- 对于大多数企业来说,GPU加速卡价格高昂、更新快,自己囤卡既不灵活也容易造成闲置。与此同时,训练、推理、渲染等任务对算力的需求又往往是脉冲式的——用的时候不够,不用的时候空转。GPU算力租赁因此成为一种务实的选择:企业不必一次性重资产投入,而是按需获取加速卡资源,用完即释放。天翼云依托弹性云主机与GPU云主机体系,结合云网融合资源布局,为用户提供灵活、透明、可弹性伸缩的GPU算力获取方式。
- DPU这个词最近几年在技术圈里频繁出现,但不少人对它的理解还停留在"一种高级网卡"的阶段。实际上,DPU解决的问题远不止网络通信,它涉及到数据中心里计算资源分配、性能瓶颈突破、安全隔离等多个层面。紫金DPU作为天翼云基础设施体系中的一员,承担着非常重要的角色。这篇文章尝试用尽量通俗的语言,把紫金DPU到底解决什么问题讲清楚,不堆砌术语,不做概念空转,从实际问题出发。
- 关于DPU的性能提升,市面上有很多宣传数据,动辄声称提升数倍甚至数十倍。但真正在业务环境中部署过DPU的人都知道,性能提升的大小高度依赖于具体场景,不是一张嘴说多少就是多少。这篇文章从CPU卸载的基本原理出发,结合实际测试中观察到的数据,聊聊紫金DPU在性能上到底带来了多少提升,哪些场景受益最大,哪些场景提升有限。
- DPU说到底是一块硬件芯片,但"硬件加速"这四个字背后到底包含了哪些具体的技术机制?是加了几个专用处理器核心就算加速,还是有更深层次的设计?很多人对DPU的理解停留在概念层面,知道它能加速网络和存储,但不知道加速的原理是什么。这篇文章从硬件架构的角度,拆解紫金DPU内部的加速机制,看看它到底"加速"了什么。
- 网络延迟是很多业务最关心的性能指标。从用户点击一个按钮到服务器返回结果,中间每一毫秒的延迟都可能影响用户体验和业务转化率。DPU在网络延迟优化上的表现,是评估其实际价值的重要维度。这篇文章通过一组对比测试,量化紫金DPU对服务器网络延迟的影响,看看在不同场景下延迟到底降了多少,以及为什么有些场景降得多、有些降得少。
- AI训练对计算资源的消耗是出了名的大。动辄几十张甚至上百张GPU组成的训练集群,每轮训练跑上几天甚至几周,算力成本和时间成本都非常可观。在这种背景下,任何能够缩短训练时间的技术都备受关注。DPU作为网络和存储加速硬件,在AI训练中能发挥什么作用?这篇文章从AI训练的数据瓶颈问题出发,分析紫金DPU在训练过程中的实际加速效果。
- 服务器上插的那块网络适配器,有人叫它网卡,有人叫它NIC,现在又冒出来一个DPU,价格比普通网卡贵不少。从外观上看,都是插在服务器上的PCIe板卡,有网络接口,能传输数据。那它们到底差在哪里?这篇文章不堆术语,从架构、功能、性能三个层面把紫金DPU和普通网卡的区别讲透。
- 做系统架构的人看技术,不只是看它能做什么,更看重它为什么这么做。每一项技术选择背后都体现了对问题域的理解和权衡。紫金DPU的设计不是凭空而来的,它反映了天翼云对数据中心基础设施发展趋势的判断,以及在性能、安全、成本、可运维性之间的平衡取舍。这篇文章从架构师的视角,拆解紫金DPU设计理念中的几个关键决策。
- "性能翻倍"这个词在技术宣传中出现频率很高,但很少有人真正拆解过这个说法的依据。DPU对存储IO的加速,到底能带来多大提升?在什么条件下可以接近翻倍,又在什么条件下提升有限?这篇文章从存储IO数据路径出发,分析紫金DPU存储卸载的具体机制,然后结合实测数据来回答"是否翻倍"这个问题。
- 云环境下的安全隔离,核心问题是多租户之间的数据和流量隔离。传统方案依靠虚拟化软件实现网络隔离,但软件方案有一个根本性的弱点:它运行在宿主机上,如果宿主机操作系统被攻破,软件隔离可以被绕过或篡改。DPU提供了另一种可能性——将安全隔离下沉到硬件层面。紫金DPU在这方面的能力到底靠谱不靠谱?这篇文章从安全威胁模型出发,分析紫金DPU的安全隔离机制和它的实际防护能力。
点击加载更多