Novita AI の Macaron V1 Tall:チャット、エージェント、コーディング向けの無料 262K コンテキスト MoL モデル
Macaron V1 Tall は、Novita AI 上で 262K コンテキスト、関数呼び出し、推論、期間限定無料価格を提供します。
Macaron V1 Tall は、Novita AI 上で 262K コンテキスト、関数呼び出し、推論、期間限定無料価格を提供します。
Novita AI で Ling-3.0-flash を無料で利用:124B MoE モデル、5.1B アクティブパラメータ、262K コンテキスト、推論、関数呼び出しに対応。
Macaron V1 Venti は、コーディング、エージェント、GenUI 向けの 748B Mixture-of-LoRA フラッグシップモデルです。仕様、Novita AI での利用可能性、価格、最適なユースケースをご覧ください。
Novita AI 上の V4 Flash API を介して、Claude Code で DeepSeek を使用します。4 つの環境変数を設定し、100 万トークンのコンテキストを取得し、Claude Sonnet と比較してコストを 20 分の 1 に削減します。
Qwen3.7-Max が Novita AI で利用可能になり、エージェンティックコーディングと長コンテキストワークフローに対応します。API アクセス、料金、制限、ユースケースを確認してください。
PegaFlow外部KVキャッシュは、vLLMサービングチームが再起動、インスタンス間、RDMAノード間でKVキャッシュを保持・共有することを可能にします。
DeepSeek-V4-Proは1.6TパラメータのオープンソースMoEモデルで、LiveCodeBenchスコア93.5(#1)と1Mトークンのコンテキストを実現。Novita AIから利用可能です。
Ling-2.6-flashは104B MoEモデル(7.4Bアクティブ)で、340 tokens/sの速度とエージェントベンチマークにおいてNemotron-3-Super比約7倍のトークン効率を実現。OpenRouterで利用可能。
Gemma 4 が Novita AI で利用可能に — 4つのモデルサイズ、3つのアーキテクチャ、全ラインナップでビジョン対応、E2B および E4B で音声対応。
Novita AIでKimi K2.5を利用開始 - 256Kコンテキスト、ビジョン+テキスト、思考モード、エージェントスウォームを備えたMoonshot AIのフラッグシップマルチモーダルエージェントモデル
TTS および音声エージェント向け Speech 2.6 の利点を探る。アプリケーションにおける生産性と効率性をどのように向上させるかを解説します。
Novita AIでKimi-K2-Thinkingにアクセス — 1兆パラメータのオープンソース推論モデル、256Kコンテキスト、200以上のツール呼び出し、SOTAパフォーマンスを実現。
Novita AI上のPaddleOCRは、109言語対応、強力なOCR、表認識、数式抽出を備えたコンパクトな0.9Bモデルで、最先端の多言語文書解析を実現します。