Novita AI の Ling-3.0-Flash-Sante:医療向けチューニング済み MoE API と料金
Novita AI の Ling-3.0-Flash-Sante を解説:医療向けにチューニングされた 124B MoE、256K コンテキスト、推論、関数呼び出し、現在の API 料金。
Novita AI の Ling-3.0-Flash-Sante を解説:医療向けにチューニングされた 124B MoE、256K コンテキスト、推論、関数呼び出し、現在の API 料金。
Novita AI 上の GLM-5.3 Flash を探る: モデル ID、1M コンテキスト、128K 出力、マルチモーダル入力、価格、そしてコーディングエージェントにおける位置づけ。
DeepSeek V4 Pro 0813 は、Novita AI での GA リリースです。DSpark、MIT ライセンス、1M コンテキスト、更新された料金を備えています。
Novita AI で Ling-3.0-flash を無料で利用:124B MoE モデル、5.1B アクティブパラメータ、262K コンテキスト、推論、関数呼び出しに対応。
Macaron V1 Venti は、コーディング、エージェント、GenUI 向けの 748B Mixture-of-LoRA フラッグシップモデルです。仕様、Novita AI での利用可能性、価格、最適なユースケースをご覧ください。
Novita AI 上の V4 Flash API を介して、Claude Code で DeepSeek を使用します。4 つの環境変数を設定し、100 万トークンのコンテキストを取得し、Claude Sonnet と比較してコストを 20 分の 1 に削減します。
Qwen3.7-Max が Novita AI で利用可能になり、エージェンティックコーディングと長コンテキストワークフローに対応します。API アクセス、料金、制限、ユースケースを確認してください。
PegaFlow外部KVキャッシュは、vLLMサービングチームが再起動、インスタンス間、RDMAノード間でKVキャッシュを保持・共有することを可能にします。
DeepSeek-V4-Proは1.6TパラメータのオープンソースMoEモデルで、LiveCodeBenchスコア93.5(#1)と1Mトークンのコンテキストを実現。Novita AIから利用可能です。
Ling-2.6-flashは104B MoEモデル(7.4Bアクティブ)で、340 tokens/sの速度とエージェントベンチマークにおいてNemotron-3-Super比約7倍のトークン効率を実現。OpenRouterで利用可能。
Gemma 4 が Novita AI で利用可能に — 4つのモデルサイズ、3つのアーキテクチャ、全ラインナップでビジョン対応、E2B および E4B で音声対応。
Novita AIでKimi K2.5を利用開始 - 256Kコンテキスト、ビジョン+テキスト、思考モード、エージェントスウォームを備えたMoonshot AIのフラッグシップマルチモーダルエージェントモデル
TTS および音声エージェント向け Speech 2.6 の利点を探る。アプリケーションにおける生産性と効率性をどのように向上させるかを解説します。