Ling-3.0 Tiny 现已作为无服务器模型在 Novita AI 上提供,适用于希望拥有小型稀疏 MoE 端点且具备大工作上下文的团队。当前列表显示 inclusionai/ling-3.0-tiny,总参数 7.9B,每个 Token 约 1.3B 活跃参数,256K 上下文窗口,并支持函数调用。Novita 目前将该模型的输入和输出 Token 价格均列为 $0。
Ling-3.0 Tiny 核心要点
- Ling-3.0 Tiny 是一款小型 MoE 模型,而非密集模型。
- Novita 列出总参数 7.9B,每个 Token 约 1.3B 活跃参数。
- 当前上下文窗口为 256K Token。
- 托管端点支持函数调用。
- 定价当前显示为输入 $0 和输出 $0,因此今天它是一个强劲的评估目标。
Novita AI 上的 Ling-3.0 Tiny 是什么?
Ling-3.0 Tiny 是 Novita AI 上 Ling 3.0 系列中的紧凑型成员。该模型的主要亮点在于效率:它在保持较小活跃计算量的同时,仍提供了大上下文窗口,适用于长提示词、代理轨迹和工具输出。
这种组合使其非常适合那些不需要旗舰模型,但又不仅仅需要一个玩具端点的场景。例如轻量级工具使用助手、文档工作流、长上下文分类,以及需要保持低成本的的路由层。
Ling-3.0 Tiny 在 Novita AI 上的 API 可用性
Novita AI 将 Ling-3.0 Tiny 作为无服务器模型托管,模型 ID 为 inclusionai/ling-3.0-tiny。实时列表是了解可用性、定价和所支持功能的最准确来源。
当前的定价快照非常简单:每 1M 输入 Token $0,每 1M 输出 Token $0。如果您计划用于生产环境,请将其视为一个实时促销快照,并在做出任何成本假设之前重新检查模型页面。
Ling-3.0 Tiny 规格、上下文窗口与定价
| 字段 | 当前详情 |
|---|---|
| 显示名称 | Ling-3.0 Tiny |
| 模型 ID | inclusionai/ling-3.0-tiny |
| 架构 | 7.9B 参数 MoE;每个 Token 约 1.3B 活跃参数 |
| 访问方式 | 无服务器 API |
| 上下文窗口 | 256K Token |
| 托管功能 | 函数调用 |
| 输入价格 | 每 1M Token $0 |
| 输出价格 | 每 1M Token $0 |
| 最佳适用场景 | 长上下文轻量级代理、工具使用和成本敏感型实验 |
为什么 Ling-3.0 Tiny 对长上下文工作流很重要
Ling-3.0 Tiny 处于一个有用的中间地带。它足够小,适合高容量评估,同时其上下文窗口又足够大,可以保持真实任务状态在视野内。当请求涉及超过简短对话轮次时,这一点至关重要。
对于开发者来说,主要的权衡很简单:您获得了一个用于长上下文文本工作流的低成本端点,但在将实际流量路由到它之前,您仍应使用自己的提示词、工具调用和输出格式要求来验证模型。
何时在 Novita AI 上使用 Ling-3.0 Tiny
在以下情况使用 Ling-3.0 Tiny:
- 需要一个用于长上下文文本任务的廉价模型
- 需要在无服务器设置中支持函数调用
- 需要一个紧凑的 MoE 端点用于路由或委派
- 需要一个模型来测试代理工作流,且无需立即承担 Token 成本
何时选择其他模型而非 Ling-3.0 Tiny
如果您需要多模态输入、更大的推理预算,或针对硬编码和数学任务的不同质量配置,请选择其他模型。Ling-3.0 Tiny 是一个轻量级的发布选项,并非通用默认选择。
结论
当您希望获得稀疏 MoE 效率、长上下文和当前的零 Token 成本时,Ling-3.0 Tiny 是 Novita AI 上一个实用的选择。如果您的工作负载基于文本且由工具驱动,现在值得一试。
常见问题
模型 ID 是什么?
inclusionai/ling-3.0-tiny
它支持多大的上下文窗口?
256K Token。
目前是免费的吗?
是的。Novita 当前列出输入和输出价格均为 $0。
是否支持函数调用?
支持。
