AIHero

    模型

    输出 Token

    模型生成并返回的 Token。由于生成它们需要更多计算,计费单价通常高于输入 Token。

    Matt Pocock
    Matt Pocock

    输出 Token 是模型生成并返回的 Token。它们的费率高于输入 Token——通常约为后者的五倍——因为生成输出需要更多计算。

    模型写出的所有内容都会计入:你读到的文字、它生成的代码、工具调用,以及回答前进行的任何扩展思考。最后一项常让人意外——即使运行框架通常不向你展示推理 Token,它们仍按输出计费;提高推理投入会消耗更多这类 Token。

    输出 Token 也决定会话的速度。模型读取输入很快,但输出必须逐个 Token 生成;因此,当一个轮次感觉很慢时,几乎总是因为模型正在写出输出,而不是正在读取输入。等待时间很长,通常意味着即将得到一个很长的回答。

    用法:

    “重构会话的输入明明很少,却在快速消耗额度。”

    “智能体在重写整个文件,而不是打补丁。输出 Token 的费率大约是输入的五倍——让它只输出编辑内容,账单就会下降。”

    不只想学术语?

    加入 AI Hero,获取实用技能、AI 工程思考,以及帮助你始终走在前沿的资源。

    没有垃圾邮件,随时可以退订。

    分享