Novita AI 上的 Ling-3.0 Tiny:7.9B MoE、256K 上下文与发布定价

Novita AI 上的 Ling-3.0 Tiny:7.9B MoE、256K 上下文与发布定价

Ling-3.0 Tiny 现已作为无服务器模型在 Novita AI 上提供,适用于希望拥有小型稀疏 MoE 端点且具备大工作上下文的团队。当前列表显示 inclusionai/ling-3.0-tiny,总参数 7.9B,每个 Token 约 1.3B 活跃参数,256K 上下文窗口,并支持函数调用。Novita 目前将该模型的输入和输出 Token 价格均列为 $0。

Ling-3.0 Tiny 核心要点

  • Ling-3.0 Tiny 是一款小型 MoE 模型,而非密集模型。
  • Novita 列出总参数 7.9B,每个 Token 约 1.3B 活跃参数。
  • 当前上下文窗口为 256K Token。
  • 托管端点支持函数调用。
  • 定价当前显示为输入 $0 和输出 $0,因此今天它是一个强劲的评估目标。

Novita AI 上的 Ling-3.0 Tiny 是什么?

Ling-3.0 Tiny 是 Novita AI 上 Ling 3.0 系列中的紧凑型成员。该模型的主要亮点在于效率:它在保持较小活跃计算量的同时,仍提供了大上下文窗口,适用于长提示词、代理轨迹和工具输出。

这种组合使其非常适合那些不需要旗舰模型,但又不仅仅需要一个玩具端点的场景。例如轻量级工具使用助手、文档工作流、长上下文分类,以及需要保持低成本的的路由层。

Ling-3.0 Tiny 在 Novita AI 上的 API 可用性

Novita AI 将 Ling-3.0 Tiny 作为无服务器模型托管,模型 ID 为 inclusionai/ling-3.0-tiny。实时列表是了解可用性、定价和所支持功能的最准确来源。

当前的定价快照非常简单:每 1M 输入 Token $0,每 1M 输出 Token $0。如果您计划用于生产环境,请将其视为一个实时促销快照,并在做出任何成本假设之前重新检查模型页面。

Ling-3.0 Tiny 规格、上下文窗口与定价

字段 当前详情
显示名称 Ling-3.0 Tiny
模型 ID inclusionai/ling-3.0-tiny
架构 7.9B 参数 MoE;每个 Token 约 1.3B 活跃参数
访问方式 无服务器 API
上下文窗口 256K Token
托管功能 函数调用
输入价格 每 1M Token $0
输出价格 每 1M Token $0
最佳适用场景 长上下文轻量级代理、工具使用和成本敏感型实验

为什么 Ling-3.0 Tiny 对长上下文工作流很重要

Ling-3.0 Tiny 处于一个有用的中间地带。它足够小,适合高容量评估,同时其上下文窗口又足够大,可以保持真实任务状态在视野内。当请求涉及超过简短对话轮次时,这一点至关重要。

对于开发者来说,主要的权衡很简单:您获得了一个用于长上下文文本工作流的低成本端点,但在将实际流量路由到它之前,您仍应使用自己的提示词、工具调用和输出格式要求来验证模型。

何时在 Novita AI 上使用 Ling-3.0 Tiny

在以下情况使用 Ling-3.0 Tiny:

  • 需要一个用于长上下文文本任务的廉价模型
  • 需要在无服务器设置中支持函数调用
  • 需要一个紧凑的 MoE 端点用于路由或委派
  • 需要一个模型来测试代理工作流,且无需立即承担 Token 成本

何时选择其他模型而非 Ling-3.0 Tiny

如果您需要多模态输入、更大的推理预算,或针对硬编码和数学任务的不同质量配置,请选择其他模型。Ling-3.0 Tiny 是一个轻量级的发布选项,并非通用默认选择。

结论

当您希望获得稀疏 MoE 效率、长上下文和当前的零 Token 成本时,Ling-3.0 Tiny 是 Novita AI 上一个实用的选择。如果您的工作负载基于文本且由工具驱动,现在值得一试。

在 Novita AI 上试用 Ling-3.0 Tiny

常见问题

模型 ID 是什么?

inclusionai/ling-3.0-tiny

它支持多大的上下文窗口?

256K Token。

目前是免费的吗?

是的。Novita 当前列出输入和输出价格均为 $0。

是否支持函数调用?

支持。

推荐文章