Novita AI の Ling-3.0-Flash-Sante:医療向けチューニング済み MoE API と料金

Novita AI の Ling-3.0-Flash-Sante:医療向けチューニング済み MoE API と料金

Ling-3.0-Flash-Sante は、医療に特化した言語ワークフローを評価する開発者向けに、Novita AI でサーバーレスのテキスト専用 API として提供されています。現在の Novita の掲載情報では、トークンあたり約 5.1B のアクティブパラメータを持つ 124B の Mixture-of-Experts モデル、262,144 トークンのコンテキストウィンドウ、最大 32,768 トークンの出力、推論・関数呼び出し対応、そして 2026 年 9 月 4 日時点で期間限定無料と表示された入力・出力とも $0 の料金が確認できます。これは、研究、検索、要約、ワークフロー支援のための開発者向け API として捉えるのが適切であり、医療機器や資格のある専門家による臨床判断の代替ではありません。

主な要点

  • Ling-3.0-Flash-Sante は Ling 3.0 ファミリーの医療向けチューニング版で、Novita は医療知識の推論、臨床安全性、エビデンスに基づく検索、長期的な医療タスクの強化を説明しています。
  • ホストされているモデルはスパースな 124B MoE で、トークンあたり約 5.1B のアクティブパラメータを使用します。
  • Novita は現在、262,144 トークンのコンテキストと最大 32,768 トークンの出力を掲載しています。
  • エンドポイントはテキスト入力・テキスト出力に対応し、サーバーレスアクセス、推論、関数呼び出しも利用できます。画像入力は掲載されていません。
  • 現在の価格は入力 1M トークンあたり $0、出力 1M トークンあたり $0 ですが、掲載情報では期間限定無料と表示されています。本番計画の前に料金を再確認してください。

Ling-3.0-Flash-Sante とは?

Ling-3.0-Flash-Sante は、Novita AI の Ling-3.0-flash の医療向け派生版です。同じファミリーのスパース MoE 設計を維持しつつ、医療用語、エビデンス指向の検索、臨床文書分析、複数のステップにまたがるタスクを含む開発者ワークフローを対象としています。この位置づけの出典は Novita のモデルページであり、臨床精度の順位付けを裏付ける公開ベンチマーク表は提供されていません。

このモデルは合計 124B のパラメータを持ち、トークンごとに約 5.1B のパラメータをアクティブにします。この違いはモデル名とデプロイ構成を解釈する際に重要です。124B は合計パラメータ容量を表し、アクティブパラメータ数は各トークンで使用されるおおよその量を表します。これは、あらゆるワークロードが他の 5.1B モデルと同じレイテンシー、コスト、品質になることを示すものではありません。

Sante 版は、開発者が制御するアプリケーション向けの言語モデルエンドポイントとして理解してください。情報の整理、構造化された要約の下書き、ワークフローを通じて提供されたエビデンスの検索、ツールを使うエージェントの支援などに役立ちます。情報源の選択、アクセス制御、検証、人間によるレビュー、およびドメイン固有の義務は引き続きアプリケーション側にあります。生成された回答を診断、治療指示、または独立した臨床判断として使用しないでください。

Novita AI ではどのように利用できますか?

Novita はこのモデルを Serverless API を通じてホストしています。正確なモデル ID は inclusionai/ling-3.0-flash-sante で、ライブの Ling-3.0-Flash-Sante モデルページ には、現在の利用可能性、制限、対応モダリティ、機能、料金が掲載されています。

Novita の OpenAI 互換ベース URL は https://api.novita.ai/openai です。ステップバイステップのリクエスト例は、Ling 3.0 Flash Sante OpenAI 互換 chat completions クイックスタート を参照してください。すでに OpenAI SDK または互換クライアントを使用しているアプリケーションの場合、主な統合変更点はモデル ID です。モデルページには現在、chat/completions エンドポイントファミリーと Anthropic 互換エンドポイントのラベルが表示されています。本番サービスに組み込む前に、現在のドキュメントでエンドポイントとクライアントの動作を確認してください。

このモデルは、2026 年 9 月 3 日に Novita のモデルカタログに追加されました。Novita の OpenAI models エンドポイント は、モデルがカタログに引き続き含まれているかどうかを確認し、現在のモデルメタデータをプログラムで確認するための適切な情報源です。

仕様と料金の概要

以下のスナップショットは、2026 年 9 月 4 日時点の Novita モデルページとモデルカタログで確認したものです。料金と制限は運用データであるため、コスト見積もりを公開したりアプリケーションの制限を設定したりする前に再確認してください。

項目 現在の詳細 出典 / 確認日
表示名 Ling-3.0-Flash-Sante Novita モデルページ、2026年9月4日
モデル ID inclusionai/ling-3.0-flash-sante Novita モデルページ、2026年9月4日
アーキテクチャ 合計 124B パラメータ。トークンあたり約 5.1B のアクティブパラメータ Novita モデルページ、2026年9月4日
アクセス サーバーレス API Novita モデルページ、2026年9月4日
ベース URL https://api.novita.ai/openai Novita モデルページ、2026年9月4日
エンドポイントファミリー chat/completions と Anthropic 互換エンドポイントのラベル Novita モデルページ、2026年9月4日
コンテキストウィンドウ 262,144 トークン(256K) Novita モデルページ、2026年9月4日
最大出力 32,768 トークン(32K) Novita モデルページ、2026年9月4日
入力モダリティ テキスト Novita モデルページ、2026年9月4日
出力モダリティ テキスト Novita モデルページ、2026年9月4日
ホスト提供機能 推論と関数呼び出し Novita モデルページ、2026年9月4日
入力料金 $0 / 1M トークン。期間限定無料と表示 Novita モデルページ、2026年9月4日
出力料金 $0 / 1M トークン。期間限定無料と表示 Novita モデルページ、2026年9月4日
最適な用途 テキストベースの医療情報ワークフローとエージェント評価 検証済みの掲載情報に基づく編集ガイダンス、2026年9月4日

価格ゼロは評価には便利ですが、恒久的な料金表として扱うべきではありません。テスト中はトークン使用量、レイテンシー、リトライ、タスク結果を記録してください。プロモーションが終了した場合、それらの測定結果は、モデルを維持するか、選択したタスクだけをルーティングするか、別のエンドポイントに移行するかの判断に役立ちます。

開発者はこれで何を構築できますか?

医学文献とエビデンスのワークフロー

アプリケーションは承認された情報源から文書を取得し、関連するテキストをモデルに渡して、引用または出典範囲を明示した統合結果を依頼できます。これはワークフローの設計パターンであり、モデルが関連するすべての論文を特定したり、すべての医学的記述を正しく解釈したりすることを保証するものではありません。検索品質と情報源の鮮度が結果の中心となります。

長文書のレビューと要約

262K のコンテキストウィンドウにより、長いメモ、ポリシー、研究論文、または取得した複数のパッセージを 1 つのリクエストに含める余地があります。コンテキストが大きいからといって、チャンキング、重複排除、出所追跡、出力チェックが必要なくなるわけではありません。1 つの長いプロンプトが段階的なワークフローよりも自社の文書に対して良い結果をもたらすかどうかをテストすることは依然として有用です。

ツールを使用する情報アシスタント

関数呼び出しを使用すると、モデルを承認済みの検索、データベース、ワークフローツールに接続できます。医療の現場では、ツールには狭い権限と明示的な検証が必要です。たとえば、アプリケーションがモデルに文書 ID の検索を要求させる一方、レコードを取得してソース参照を保持する処理は決定論的なコードで行うようにできます。モデルに、レコードの変更、患者向けの指示の送信、資格のある専門家の判断が必要な意思決定を無監視で行う権限を与えてはいけません。

医療製品をめぐる一般的な推論とコーディング

また、この掲載情報では、一般的な推論、コーディング、エージェント機能が保持されていることも説明されています。そのため、このエンドポイントは、テスト生成、スキーママッピング、データクリーニングヘルパー、社内ドキュメント、評価ハーネスなど、医療ワークフローを支えるソフトウェアに関連します。これらはエンジニアリングタスクであるため、医療コンテンツのタスクとは別に検証してください。

どのような場合に使うべきですか?

以下の条件のいくつかに該当する場合は、Ling-3.0-Flash-Sante を選択してください。

  • 入力と出力がテキストのみである。
  • ワークフローが医療ドメイン向けの特性の恩恵を受けられるが、一般的な推論やコード生成も必要である。
  • 長い文書や複数ステップのエビデンス検索において、256K のコンテキストウィンドウが有用である。
  • マネージドなサーバーレスエンドポイントで推論と関数呼び出しを評価したい。
  • 情報源に基づくチェックを構築でき、重大な影響がある場面では人間を意思決定ループに残すことができる。

現在の無料提供により、管理された比較実験の現実的な候補になります。有用な評価セットには、代表的な文書、曖昧な用語、欠落したエビデンス、矛盾する情報源、ツールの失敗、拒否・エスカレーションのケースを含める必要があります。単一の回答が流暢に聞こえるかどうかだけでなく、ワークフロー全体が有用かどうかを測定してください。

どのような場合に別のモデルの方が適していますか?

Ling-3.0-Flash-Sante は、あらゆるアプリケーションにとって正しいデフォルトとは限りません。画像入力が必要な場合は別のエンドポイントを選択してください。現在の Novita の掲載情報では、テキスト入力とテキスト出力のみが示されているためです。医療向けと説明されているモデルでも、このエンドポイント経由でスキャン画像、チャート、写真、その他の視覚データを解釈できるとは想定しないでください。

また、厳密な構造化出力の保証が中心的な要件である場合も、別のモデルを選ぶとよいでしょう。関数呼び出しは掲載されていますが、構造化出力は現在モデルページに表示されている機能には含まれていません。必要な正確なスキーマ動作をテストし、生成されたデータを受け入れる前に決定論的な検証を使用してください。

最後に、独立して発表された臨床検証、契約上のサービスレベル目標、安定した有料価格、規制対象製品の意思決定が必要な場合は、別のモデルまたは多層的なワークフローを使用してください。Novita の掲載情報は開発者の評価とアプリケーション構築をサポートするものであり、モデルが医療機器または臨床的に検証された意思決定者であることを確立するものではありません。

API ワークフローにはどう適合しますか?

大まかには、既存の OpenAI 互換アプリケーションには次のものが必要です。

  1. Novita API キー
  2. ベース URL https://api.novita.ai/openai
  3. モデル ID inclusionai/ling-3.0-flash-sante

リクエスト形式については、まず Ling-3.0-flash API クイックスタート を参照し、次に Sante モデル ID に置き換えて、小さな機密情報を含まないテストプロンプトを使用してください。必要な保護措置と権限がアプリケーションにない限り、個人の健康情報やその他の機密データを実験に含めないでください。

本番に近い評価では、不要な機密コンテンツを保持せずにリクエストメタデータを記録してください。入力・出力のトークン数、応答レイテンシー、ツール呼び出しの成功率、情報源のカバレッジ、検証の失敗、エスカレーションの結果を追跡します。こうした測定値は、あるモデルが普遍的に優れているという裏付けのない主張よりも、導入判断に役立ちます。

最終的な推奨事項

Ling-3.0-Flash-Sante は、医療向けの位置づけ、推論、関数呼び出しを備えた、長いコンテキストのテキスト専用 MoE エンドポイントが必要な場合に試す価値があります。Novita は現在、期間限定の入力・出力 $0 の掲載を通じて、その評価を低コストで実現しています。試すべき最も強い理由は、主張されている臨床スコアではなく、焦点を絞ったモデルの説明、大きなコンテキストウィンドウ、そして自身のワークフローで測定できるマネージド API の組み合わせです。

現在の無料期間を活用してエビデンスを構築してください。信頼できるベースラインと比較し、検索やツール使用の失敗をテストし、出力をソース文書と照合して検証し、本番コミットの前に最新の価格を確認します。人に影響を与える意思決定については、専門家によるレビューとアプリケーションの保護策を維持してください。

Novita AI で Ling-3.0-Flash-Sante を評価する

FAQ

Ling-3.0-Flash-Sante のモデル ID は?

Novita API リクエストでは inclusionai/ling-3.0-flash-sante を使用します。

Ling-3.0-Flash-Sante は Novita AI で無料ですか?

2026 年 9 月 4 日に確認した Novita の掲載情報では、入力トークン 1M あたり $0、出力トークン 1M あたり $0 と表示され、価格は期間限定無料とされています。予算を組んだり有料サービスを開始したりする前に、ライブのモデルページを確認してください。

コンテキストと出力の制限は?

Novita は 262,144 トークンのコンテキストウィンドウと最大 32,768 トークンの出力を掲載しています。

ビジョン(画像入力)には対応していますか?

現在のホストエンドポイントでは、ビジョンサポートは掲載されていません。モデルページにはテキスト入力とテキスト出力が表示されています。

推論と関数呼び出しには対応していますか?

はい。現在の Novita の掲載情報には、ホスト提供機能として推論と関数呼び出しが含まれています。

医療機器や診断ツールですか?

いいえ。これは開発者向けの言語モデル API です。アプリケーションは生成された出力を診断、治療推奨、または資格のある医学的判断の代替として提示すべきではありません。

関連記事