什么是 AI Token(代币)?
AI Token 是 AI 模型读取和产出文字时所用的最小单位,也是它用来计算和收费的单位。一个 token 大约等于四分之三个英文字,所以 1,000 个 token 约等于 750 个英文字,也就是密密麻麻的一页纸。
当你向 AI 工具输入一条问题,你的文字会先被拆成一个个 token,模型才能处理。它的答案,同样是一个 token、一个 token 地生成出来。AI 所做的一切,都是以 token 为单位。
为什么 AI 用 token 而不是用「字」?
AI 之所以用 token,是因为 token 能让模型一致地处理任何语言、拼法或符号,而不只是整齐的英文单词。一个 token 往往是一个「字的碎片」,这正是为什么 token 数目很少会等于你写了多少个字。
一个简单例子就能说明。像「the」这种常见字是一个 token;而较长的字如「monetization」,可能被拆成三个 token,例如「mon」「etiz」「ation」。数字、标点、表情符号和中文字,也各自占用 token。
中文的比例又不一样。中文字相对于它的长度,往往比英文用掉更多 token,因此同样「看起来一样长」的中文提示,处理成本可能更高。对于中英夹杂运作的香港企业来说,这一点值得留意。
按 token 收费是怎样运作的?
按 token 收费,意思是你按实际用量付费,以 token 计算,而不是付一个固定的月费。账单的算法是:输入 token 数目乘以输入单价,加上输出 token 数目乘以输出单价。
有两个价格要留意,而且它们并不相同:
输入 token是你送进去的一切:你的问题,加上你附上的任何文件或指示。
输出 token是 AI 回复给你的一切内容。
输出 token 通常比输入 token 贵三至八倍。原因很实在:模型能一次过快速读完你的整条提示,但写答案时却要一个 token、一个 token 地产出,这需要多得多的运算力。
AI token 实际上要多少钱?
Token 价格以「每一百万个 token」报价,并因模型而有很大差异。截至 2026 年,一个便宜而快速的模型(如 Gemini Flash Lite)每百万个输入 token 约 0.08 美元、输出约 0.30 美元;而顶级模型(如 Claude Opus 4.5)则约为输入 5 美元、输出 25 美元。
这些数字很抽象,换个说法就清楚了。一百万个 token 大约是 75 万字,相当于九本普通长度的小说。对大部分中小企来说,草拟电邮或摘要文件这类日常工作,在较便宜的模型上每次只需几美分。
实际的教训是:你选哪个模型,比你输入时多小心更重要。用旗舰模型去做一件简单的事,成本可能是一个同样胜任的轻量模型的五十倍。
这对中小企为什么重要?
重要,是因为 token 收费正好解释了:为什么两家用「同一款 AI」的公司,账单可以相差极远。理解 token,能把 AI 成本由一个谜团,变成你可以预测和控制的东西。
想象一家用 AI 回复客户查询的店铺。如果每次回复都附上一大段背景指示,而且每一条信息都重复发送,那些输入 token 就会在每则信息上重复计算,悄悄推高账单。把那段背景精简,或聪明地重用,就能大幅削减成本。
反过来说,这也是机会。当你明白一次摘要只需不足一美分,你就不会再「省着用」AI,而是放心地用它去处理那些积少成多的小任务,用微不足道的成本,换回大量员工时间。
如何把你的 AI token 成本降低?
降低 token 成本的方法,是让模型配合任务、把提示保持精简,以及重用重复的背景资料而非每次重新发送。这些小习惯,在规模化之后会累积成可观的节省。
四个实用做法:
一、简单工作用轻量模型。把昂贵的旗舰模型,留给真正困难的任务。大部分日常的草拟和摘要,在较便宜的模型上都运作得很好。
二、提示要聚焦。冗长、东拉西扯的指示,全都是你要付钱的输入 token。清楚说明你要什么,然后就停。
三、要多长就讲明多长。如果你只想要三行摘要,就说出来。放任 AI 写十段你根本不要的内容,等于为你将会删掉的输出付钱。
四、用缓存重用背景。如果你每次请求都送出同一段长背景,大部分供应商都提供「提示缓存」,可为重复的输入打七五折至九折。问问你的工具或供应商是否已开启。
关于 token 的常见误解
最常见的误解,是以为一个 token 等于一个字。并非如此,它通常只是一个碎片,所以你的 token 数几乎总是比字数高。
第二个迷思,是以为只有你的问题才收费。事实上,AI 的答案每个 token 通常比你的问题贵几倍,所以长篇大论的回复,才是更大的开支。
第三个迷思,是以为月费订阅和 token 收费是同一回事。消费级订阅把一定用量打包进固定月费里;而商业工具和 API 所用的 token 收费,则是你用多少、算多少。很多企业会为不同用途同时使用两者。
常见问题
中文字是不是比英文用掉更多 token?
通常是的。中文相对于它看得见的长度,往往比英文用掉更多 token,因此同样「看起来一样大」的工作量,中英夹杂的香港工作可能比纯英文的处理成本稍高。
我怎样看到自己用了多少 token?
大部分商业 AI 平台都会在仪表板显示 token 用量,而网上也有免费的 token 计数器,让你在发送前贴上文字,先估算一条提示的用量。
如果我只用聊天机器人订阅,需要担心 token 吗?
相对不用。固定的月费计划,把 token 的算式藏在一个固定收费背后。token 最要紧的时候,是当你把 AI 建进自己的工具,或使用按用量收费的商业服务。
重点回顾
Token 是每一个 AI 工具背后那个隐形的计数表。一旦你明白你是按「文字碎片」付费、答案比问题贵、而你选的模型决定了单价,AI 收费就不再是一个黑盒。
你不需要用手去数 token,只需要知道它存在,就能选对工具、放心使用,不必再担心收到一张吓人的账单。懂AI,更懂你 UD相伴,AI不冷。
想要一套符合你预算的 AI?
理解 token,是控制 AI 成本的第一步。下一步,是选对工具、并把它设定得既有价值又不浪费。UD 协助香港企业做这件事已经 28 年,我们会手把手教你,由你的第一次成本估算,到一套能自己回本的方案。