画像 / AI拡大
AI画像拡大:ブラウザで2×または4×
Real-ESRGAN General x4v3でPNG、JPEG、WebP画像を拡大します。スライダーで元画像と結果を比較し、PNGの透明度を保持したり、品質を調整してJPEGでダウンロードしたりできます。
AI画像拡大:ブラウザで2×または4×: AIモデルのReal-ESRGANがブラウザ上で動作し、単にピクセルを拡大してぼかすのではなく、エッジやテクスチャを補いながら画像を幅・高さともに4倍に描き直します。大きな画像は、小さく重なり合うタイルに分けて処理し、目立つ継ぎ目がないように結合します。より小さい結果にしたい場合は2×を選択してください。画像がアップロードされることはありません。 サーバーへのファイルアップロードは一切なく、100%ブラウザ内でローカル実行します。
- カテゴリ
- 画像ツール
- 実行回数
- ブラウザ内で
- コスト
- 無料 · 登録不要
- 提供状況
- すぐに使えます
完全にブラウザ内で実行します
AIによる拡大ではもっともらしいディテールを生成しますが、実際のディテールや顔、テキストを正確に復元することはできません。
Xintao Wang氏および貢献者によるReal-ESRGAN General x4v3、Qualcomm AI Hubによるエクスポート。BSD-3-Clause。ONNX Runtime Web: MIT。
Real-ESRGANの研究とエクスポート
Xintao Wang、Liangbin Xie、Chao Dong、Ying Shan。Real-ESRGAN: Training Real-World Blind Super-Resolution with Pure Synthetic Data。ICCV Workshops(ICCVW)、2021年。出典: https://openaccess.thecvf.com/content/ICCV2021W/AIM/html/Wang_Real-ESRGAN_Training_Real-World_Blind_Super-Resolution_With_Pure_Synthetic_Data_ICCVW_2021_paper.html
このツールでは、固定された128 × 128 RGB入力と512 × 512出力を使用するQualcomm AI Hubのfloat ONNXエクスポート、Real-ESRGAN General x4v3を使用しています。リポジトリ: https://github.com/xinntao/Real-ESRGAN 。エクスポートカタログ: https://aihub.qualcomm.com/models/real_esrgan_general_x4v3 。
BSD-3-Clauseとランタイムの帰属表示
Real-ESRGAN: copyright (c) 2021、Xintao Wang、BSD-3-Clause。再配布時には著作権表示、条件、免責事項を保持してください。著作権者および貢献者が派生製品を推奨していると受け取られる表示は禁止されています。同梱の通知: /data/esrgan-x4v3/LICENSE-realesrgan.txt および /data/esrgan-x4v3/LICENSE-qualcomm.txt 。
ONNX Runtime Web 1.30.0: Microsoft Corporationの著作権、MITライセンス。著作権表示および許諾通知は、/data/ort/LICENSE-onnxruntime.txt にあるセルフホスト型ランタイムに付属しています。モデルとランタイムはブラウザ内でローカルに使用されます。
使い方
- 1メガピクセル以下、長辺2,000 px以下、20 MB未満の画像を選択するか、ドロップします。
- 2×または4×を選択して開始します。タイルの進行状況を確認したり、いつでもキャンセルしたりできます。
- 処理前と処理後を比較し、PNGでダウンロードするか、JPEGの品質を選択してダウンロードします。
プライバシーと制限事項
画像がブラウザの外部に送信されることはありません。ランタイムとモデルは、開始したときだけこのサイト自身のオリジンから読み込まれます。外部のAIサービスは使用しません。
関連ツール
よくある質問
顔やテキストを正確に復元できますか?
AIによる拡大は、もっともらしいディテールを生成するものです。実際のディテールや顔、テキストを正確に復元することはできません。正確さが重要な用途で使用する前に、結果を確認してください。
拡大にはどのくらい時間がかかりますか?
所要時間は、お使いのデバイスと画像サイズによって異なります。大きな画像では数分かかる場合があります。推論の開始後にタイル数と残りの処理時間の目安が表示されます。読み込み、リサンプリング、エンコードには別途時間がかかります。キャンセルするとワーカーが終了します。
透明度はどうなりますか?
PNGではアルファチャンネルが保持され、バイキュービック補間で拡大した後、モデルのRGB出力と再結合されます。JPEGでは透明部分が白で塗りつぶされます。2×のリサンプリングでは、色のにじみを防ぐために事前乗算アルファが使用されます。
入力に制限があるのはなぜですか?
ブラウザのメモリ使用量を管理しやすくするため、入力は1メガピクセル、長辺2,000 px、20 MBに制限されています。4×に拡大すると、ピクセル数は16倍になります。大きな画像は、先にサイズを変更してください。
無料ツール · ブラウザ内で · アカウント不要