novita:開発者とエージェントのためのAIネイティブクラウド

アイデアから始めよう 1つのプラットフォーム · 多彩なモデル

無料で始められます · 契約不要でお試しください

または、例を試す

導入企業・サービス

Hugging Face
TiDB
Kilo Code
Quora
OpenRouter
Fish Audio
hygo
Gizmo
Simular
Wiz.AI
モデルAPI
モデルAPIカードの背景
LLM 画像 音声 動画 ビジョン
モデル["KIMI-K2.5"]
200+ モデル▪ 200MS のレイテンシー▪ 99.5% の稼働率
1サーバーレスモデルAPI

単一のAPIで200+のモデルを利用。インフラの管理は不要です。

テキスト、画像、音声、動画。すべてサーバーレスで、そのまま本番環境に導入できます。APIを呼び出すだけで、実行はお任せください。料金は時間単位ではなく、トークン単位です。

AIモデルを見る
GLMモデル

GLM 5.3 Flash

入力 $0.15/Mt · 出力 $0.5/Mt
1M コンテキスト

LLM
DeepSeek モデル

DeepSeek V4.1 Flash

$0.3/Mt 入力 · $1.2/Mt 出力
1M コンテキスト

LLM

Hy4 プレビュー

$0.834/Mt 入力 · $2.501/Mt 出力
977K コンテキスト

LLM
DeepSeek モデル

DeepSeek V4.1 Flash

$0.3/Mt 入力 · $1.2/Mt 出力
1M コンテキスト

LLM
2専用エンドポイント

プライベートエンドポイント。安定したパフォーマンス。ほかのユーザーの影響を受けません。

モデルもコンピューティングリソースも、あなた専用。リソースが分離されているため、どのスループットでもレイテンシーは安定。本番環境では、リトライを前提にできないから。

エンドポイントを見る
専用エンドポイント
BASE_URL
[ "API.NOVITA.AI/YOUR-ENDPOINT" ]
稼働中
P99
53MS
スループット
1,252 TOK/S
レイテンシー · 直近40件のリクエスト
エージェントサンドボックス
エージェント用サンドボックス
✧ エージェント[「コーディングエージェント」]
コーディングエージェント · 稼働中サンドボックス実行環境
▣  テストスイートを実行 · pytest待機中
▣  修正を書き込み · パッチ適用済み実行中
▣  バグを特定 · nullポインター完了
▣  コードベースを読み込み · routes.py完了
起動時間
~200MS
分離
完全
課金
秒単位
ステータス
稼働中
1エージェントサンドボックス

安全で分離された実行環境。実際にタスクをこなすエージェントのために。

ノートブックではありません。自分で設定するコンテナでもありません。エージェントが実行され、ツールを使い、モデルを呼び出し、タスクを遂行するために設計された環境です。毎回、クリーンかつ分離された状態で動作します。

エージェントを構築
GPU クラウド
GPUクラウド01
▣ GPU[フラッグシップ]
GPU モデル

NVIDIA H100 ● 稼働中

8× GPUS

GPU メモリ

80 GB HBM3×8

VCPU
96
メモリ
960
ストレージ
2000
1GPU インスタンス

完全に制御できる GPU マシン。数秒で利用開始。

専有 GPU インスタンスを完全に制御し、モデルのデプロイ、推論の実行、ゼロからの学習ができます。予測可能なパフォーマンス。リソースの共有なし。想定外のこともありません。

GPU を探す
2サーバーレス GPU

ジョブを送信。あとはお任せください。

インスタンスのプロビジョニングは不要。アイドル状態のコンピューティングリソースへの支払いも不要。Novita が GPU リソースを自動的に割り当て、負荷に応じてスケールアップし、完了後はゼロまでスケールダウンします。支払うのは実行した分だけです。

GPU ジョブを実行
GPUクラウド02
▣ ジョブ──● キューに登録済み実行中完了
GPUを割り当て中
リソース
● 割り当て中
割り当て済み
自動
期間
オンデマンド
コスト
使用ごと
アイドル時間
なし
GPUクラウド03
▣ クラスター["CLUSTER-01"]
CLUSTER-01 · 6 ノードNVLINK · GPUDIRECT RDMA
NODE-01
51%
NODE-02
79%
NODE-03
86%
NODE-05
89%
NODE-06
65%
NODE-07
81%
GPU  8× NVIDIA H200
GPUメモリ  GPUあたり141 GB HBM3e
ノード  6 / 6
ネットワーク  400 Gb/s RDMA
3ベアメタル

最高のパフォーマンス。抽象化によるオーバーヘッドはゼロ。

大規模な推論、トレーニング、スループットを妥協できないエンタープライズ環境向けの専用物理GPUクラスター。ハードウェアを専有したいなら、これが最適です。

ベアメタルを見る
Novita AIが選ばれる理由

最初からAIのために構築。あなたが実際に開発するもののために設計。

開発を始める
インフラのコストと価値の比較

優れた価格性能比

大手クラウドプロバイダーより最大50%低価格。品質を犠牲にしたからではなく、インフラを自社で構築したからです。

本番環境の信頼性を示すイラスト

本番環境に求められる信頼性

低レイテンシー、高スループット、安定した稼働を大規模環境でも実現するインフラ。

1つのプラットフォーム上のAIスタックの構成要素

AIスタック全体を支える単一のプラットフォーム

モデルAPI、GPUインフラ、エージェントランタイムを1つのプラットフォームに。

ワークロードに応じたインフラのスケーリング

ワークロードに合わせて拡張

小規模から始め、APIから専用クラスターまでシームレスに拡張。

テクニカルサポートの会話を描いたイラスト

必要なときに頼れる専任サポート

AIインフラを熟知したチームによる迅速な技術サポート。

お客様の声

私たちの言葉だけでなく、お客様の声をお聞きください。

🤗 Hugging Face

「Novita AIが新たにリリースされたモデルを迅速にデプロイしてくれることに感謝しています。同社のチームは、安定した本番環境向けの推論サポートを、しばしばリリース初日からいち早く提供しています。このスピードは、オープンソースAIコミュニティ全体にとって非常に重要です。」

柔らかな照明の下で撮影された、親しみやすい技術研究者のシンプルなプロフィール写真。 研究パートナーAIコミュニティ
Fish Audio

「Novitaには、Fish Audioとして大変助けられています。信頼性の高いGPUインフラのおかげで、ハードウェアの問題に煩わされることなく、音声合成モデルの開発と改善に集中できます。サポートと性能の両面で、私たちの取り組みを前進させやすくしてくれています。」

明るくモダンなスタジオで肩から上を撮影した、音響技術研究者の写真。 音声研究責任者音声技術
★ Gizmo

「NovitaのModel APIは簡単に組み込め、AIを活用したフラッシュカードやクイズの提供に役立っています。負荷の高い処理はプラットフォームに任せられるので、インフラやスケーリングを心配せずに、より良い学習ツールの開発に集中できます。」

自然光の下でリラックスした雰囲気で撮影された、笑顔の教育テクノロジー企業創業者のプロフィール写真。 プロダクト創業者学習ツール
Kilo

「Novita AIとの協業は素晴らしい経験です。同社の推論プラットフォームにより、複数のLLMを活用した高速で信頼性の高いAIコーディングワークフローを提供できています。エージェント型ワークフローでも、実環境で優れた性能を発揮します。チームとは協力しやすく、プラットフォームも継続的に改善されています。」

温かみのある自然な雰囲気で肩から上を撮影した、技術提携責任者のプロフィール写真。 パートナーシップ責任者AIコーディングツール

本番環境向けAIの構築に必要なすべてを。

200+のモデル、オンデマンドGPU、安全なエージェント実行環境を、1つのAPIで。無料で始められ、成長に合わせて拡張できます。

始める
構築を始める
構築を始める