GPT Image 2.5 Flare & Sunburst が EvoLink で利用可能にGPT Image 2.5 を試す

API アップデート

すべてのAPIに関する最新の変更と改善情報をお届けします。

2025年12月

2025-12-31

新しいモデル |Suno AI 音楽生成が利用可能になりました

プロ品質の AI を活用した音楽作成機能を提供する Suno AI 音楽生成モデルの発売を発表できることを嬉しく思います。

新しいモデル

Suno

  • モデル ID: suno-v5 (also supports suno-v4.5plus, suno-v4.5all, suno-v4.5, suno-v4)
  • 機能: ボーカル、歌詞、楽器サポートを備えた AI による音楽生成
  • ハイライト: テキスト プロンプト、複数のモデル バージョンからプロ品質の曲を作成
  • 長さ: 1曲あたり最大4分

主要な機能

  • シンプルモード: プロンプトを入力するだけで、AI が歌詞とメロディーを自動生成します
  • カスタム モード: スタイル、タイトル、歌詞を完全に制御
  • インストゥルメンタル モード: ボーカルなしの音楽を生成します
  • 曲の拡張: 既存の曲を継続または拡張します。

ドキュメント

2025-12-29

新しいモデル |MiniMax Hailuo ビデオ生成シリーズが利用可能になりました

最先端の AI ビデオ作成機能を提供する MiniMax Hailuo ビデオ生成モデル シリーズの発売を発表できることを嬉しく思います。

新しいモデル

Hailuo 2.3 高速

  • モデル ID: MiniMax-Hailuo-2.3-Fast
  • 機能: 速度を最適化、Image-to-Video (I2V) モードのみ
  • ハイライト: 最小のレイテンシー、極端な物理効果、迅速な反復に最適
  • 解像度: 768P / 1080P
  • 持続時間: 6秒 / 10秒

Hailuo 2.3

  • モデル ID: MiniMax-Hailuo-2.3
  • 機能: Text-to-Video (T2V) および Image-to-Video (I2V) デュアル モードによる高品質出力
  • ハイライト: SOTA の指示に従い、プロレベルの品質
  • 解像度: 768P / 1080P
  • 持続時間: 6秒 / 10秒

Hailuo 02

  • モデル ID: MiniMax-Hailuo-02
  • 機能: Text-to-Video (T2V)、Image-to-Video (I2V)、First-Last-Frame (FLF) の 3 つのモードを備えたフル機能
  • ハイライト: 512P の低コスト オプションをサポートし、多様なクリエイティブ ニーズに最適です
  • 解像度: 512P / 768P / 1080P
  • 持続時間: 6秒 / 10秒

主要な機能

  • 15 のカメラ コマンド: パン、チルト、ズーム、プッシュ、プル、トラック、台座、静的、追跡、シェイクなど
  • インテリジェント モード検出: システムは入力画像数に基づいてモードを自動検出します。
  • プロンプト オプティマイザー: AI を活用したプロンプト強化により、より良い結果が得られます。
  • 高速前処理: 画像解析のオプションの高速化

ドキュメント

2025-12-26

価格調整 |アリババ モデル シリーズ フェーズ 2 プロモーション

フェーズ 1 プロモーション中のサポートとフィードバックに感謝いたします。「Alibaba Model Full Series」フェーズ 1 プロモーションの終了に伴い、フェーズ 2 の価格体系を開始します。

プロモーションの詳細

  • フェーズ 2 価格: 統一 30% オフ 公式価格 (すべての Alibaba モデル シリーズの機能をカバー)
  • 発効日: 2025 年 12 月 26 日 00:00
  • 範囲: Alibaba モデル シリーズ (画像/ビデオ生成など) 関連の課金項目

注意事項

新しい価格設定が有効になると、新しい API 呼び出しはフェーズ 2 のプロモーション価格で請求されます。過去の請求書は影響を受けません。

2025-12-17

GPT 画像 1.5 と Gemini 3 の Flash プレビューが利用可能になりました

  1. GPT 画像 1.5
    • gpt-image-1.5:
      • OpenAI の高度な画像生成モデル。
      • トゥルーカラーの精度と構造化された視覚タスク向けに最適化されています。
      • DALL-E 3 テクノロジーに基づいた強化された分析ビジュアル出力。
      • 細部の精度が向上した高品質の画像生成。
    • ドキュメント: GPT イメージ 1.5 API
  2. Gemini 3 フラッシュ プレビュー
    • gemini-3-フラッシュ-プレビュー:
      • Google の最新の高速推論モデルのプレビュー。
      • 高品質の出力を維持しながら速度が最適化されています。
      • 拡張コンテキスト ウィンドウのサポート。
      • 高スループットのアプリケーションに最適です。
2025-12-16

WAN 2.6 ビデオ生成モデルが利用可能になりました

  1. WAN 2.6 テキストからビデオへ
    • wan2.6-text-to-video:
      • Alibaba Tongyi Wanxiang 2.6 テキストからビデオへの生成。
      • 720p/1080p解像度のサポートによる品質の向上。
      • 複数の継続時間オプション: 5 秒、10 秒、15 秒。
      • より良い結果をもたらすインテリジェントなプロンプト再書き込み。
    • ドキュメント: WAN 2.6 Text to Video API
  2. WAN 2.6 画像からビデオへ
    • wan2.6-image-to-video:
      • 静止画像を動的なビデオに変換します。
      • モーションコントロールによる最初のフレームの生成。
      • 720p/1080p 品質で 5 秒、10 秒、15 秒の継続時間をサポートします。
    • ドキュメント: WAN 2.6 Image to Video API
  3. WAN 2.6 参考ビデオ
    • wan2.6-参考ビデオ:
      • 参考ビデオからキャラクターの外観と音声を抽出します。
      • 一貫したキャラクターアイデンティティを持つ新しいビデオを生成します。
      • 高度なビデオからビデオへの変換機能。
2025-12-12

GPT-5.2 と OmniHuman 1.5 を公開

  1. OmniHuman 1.5(デジタルヒューマン動画)
    • omnihuman-1.5:AI によるデジタルヒューマン動画生成で、音声駆動のリップシンクに対応します。
    • 静止画のポートレートを自然な表情と動きで話すデジタルヒューマンに変換します。1:1、9:16、16:9 のアスペクト比に対応します。
    • 音声の長さに応じて課金されます。現在の料金は料金ページが正となります。
    • ドキュメント:OmniHuman 1.5 API
  2. GPT-5.2(テキスト / マルチモーダル)
    • gpt-5.2:OpenAI がコーディングとエージェント用途に最適化したフラッグシップモデルです。
    • 400K のコンテキストウィンドウ、最大 128K の出力 Token、複雑な多段階ワークフローに適した推論能力を備えます。
    • Prompt キャッシュを内蔵し、入力・出力・キャッシュヒットは個別に課金されます。現在の料金は料金ページが正となります。
    • ドキュメント:GPT-5.2 API
2025-12-07

Z Image Turbo 画像生成モデルを公開

  1. Z Image Turbo(画像)
    • z-image-turbo:Tongyi Lab のオープンアーキテクチャをベースにした超高速な画像生成モデルです。
    • 生成は約 3 秒、最大 4K 解像度に対応し、高並列・大量生成の用途に適しています。プロンプトの再現度も高めです。
    • 現在の料金は料金ページが正となります。
  2. 主な機能
    • 複数のアスペクト比に対応:1:1、9:16、16:9 など
    • ネガティブプロンプトによる制御
    • NSFW コンテンツフィルターの切り替え
    • カスタム LoRA モデルの読み込み

ドキュメント:Z Image Turbo

2025-12-05

Kling O1 シリーズ / Seedream 4.5 を正式公開

  1. Kling O1 シリーズ(動画)
    • kling-o1-image-to-video:画像から動画を生成します。入力画像は最大 2 枚、長さは 5 秒または 10 秒です。
    • kling-o1-video-edit:AI による動画編集。参照画像でスタイルを指定でき、長さは 3〜10 秒です。
    • kling-o1-video-edit-fast:高速な動画編集モード。長さは 6〜20 秒です。
  2. Seedream 4.5(画像)
    • doubao-seedream-4.5:複数画像編集の一貫性を強化し、画像内テキストの描画を改善。最大 4K 解像度に対応します。
    • ドキュメント:Seedream 4.5

Kling O1 の 3 モデルは秒単位、Seedream 4.5 は 1 枚単位で課金されます。現在の料金は料金ページが正となります。