WANDEnhance+
EraseVibe+
Vega
Codec+
Sense
Sonic
WAND-Enhance+ は、DiTベースの大規模モデルを採用した高性能な画質向上モデルです。グローバルなコンテキスト情報を活用し、質感や細部を自然に再構築することで、映像の鮮明さと透明感を高いレベルで向上させます。
4K超解像、最大120FPSのインテリジェントフレーム補間、圧縮ノイズ除去、SDRからHDRへの変換、顔補正など、多彩な画質向上機能に対応しています。
WAND-EraseVibe+ は、生成AIを活用した高精度なシームレス消去モデルです。エンドツーエンドの潜在空間アーキテクチャにより、字幕やウォーターマークを精密に除去し、周囲の映像に自然になじむ形で再構築します。
高いフレーム間一貫性を維持し、連続再生時のちらつきや不自然なアーティファクトを抑制。複数対象の同時消去にも対応し、1日あたり10万分を超える大規模処理を実現します。
WAND-Vega は、業界特化型のコンテンツ生成モデルです。ECやショートドラマなどのユースケースに特化して学習し、商品カテゴリーへの適合、キャラクターや画風の一貫性をモデル自体に学習させています。高い成功率とスタイル制御性を備え、画像や動画をエンドツーエンドで生成します。
WAND-Codec+ は、VLMを活用したAIエンコードモデルです。各フレームのセマンティクスを解析し、AI前処理と組み合わせてビットレート配分と圧縮を最適化します。オープンソースエンコーダーと比較してビットレートを50%以上削減しながら、2倍以上の処理速度を実現。10種類以上の主要プロトコルに対応します。
WAND-Sense は音声・映像コンテンツの認識・理解モデルです。映像理解、音声認識、文字認識の能力を備えています。スポーツシーンではボール、選手、スコアボードを追跡し、試合レポートやインテリジェントな縦横変換を実現。コンテンツ制作ではハイライト集、クリップ分割、多言語字幕などの機能を支えます。
WAND-Sonic は、幅広いユースケースに対応するオーディオAIモデルです。音声合成、ボイスクローン、ボーカル分離、ノイズ除去など、音声の生成から分離、強化、修復まで一貫して対応。AIGCによる音声・音質補正、多言語吹き替え・ローカライズ、AIによるライブ配信のリアルタイム実況などに対応します。