BTC $82,935.00 +0.41%
ETH $2,506.84 +0.68%
BNB $748.55 +0.60%
XRP $1.40 -0.24%
SOL $110.04 +0.35%
TRX $0.3304 -0.13%
DOGE $0.0859 +0.05%
ADA $0.2488 -0.35%
BCH $278.68 +0.31%
LINK $13.05 +1.78%
HYPE $85.59 +1.56%
AAVE $169.14 +0.44%
SUI $1.11 +2.74%
XLM $0.1962 +0.55%
ZEC $1,226.68 +0.71%
AAPL $336.40 +0.02%
AMZN $262.61 +0.01%
GOOGL $351.25 -0.20%
MSFT $534.91 -0.10%
META $719.15 +0.18%
NVDA $230.30 +0.07%
TSLA $382.40 -0.18%
SNDK $1,596.81 +0.42%
INTC $105.08 +0.04%
SPCX $163.84 +0.48%
MU $1,036.01 +0.36%
AMD $609.96 -0.13%
BTC $82,935.00 +0.41%
ETH $2,506.84 +0.68%
BNB $748.55 +0.60%
XRP $1.40 -0.24%
SOL $110.04 +0.35%
TRX $0.3304 -0.13%
DOGE $0.0859 +0.05%
ADA $0.2488 -0.35%
BCH $278.68 +0.31%
LINK $13.05 +1.78%
HYPE $85.59 +1.56%
AAVE $169.14 +0.44%
SUI $1.11 +2.74%
XLM $0.1962 +0.55%
ZEC $1,226.68 +0.71%
AAPL $336.40 +0.02%
AMZN $262.61 +0.01%
GOOGL $351.25 -0.20%
MSFT $534.91 -0.10%
META $719.15 +0.18%
NVDA $230.30 +0.07%
TSLA $382.40 -0.18%
SNDK $1,596.81 +0.42%
INTC $105.08 +0.04%
SPCX $163.84 +0.48%
MU $1,036.01 +0.36%
AMD $609.96 -0.13%

画像モデル

すべて
記事
速報

first_img GoogleはNano Banana 2.1画像モデルを発表し、開発者の呼び出し価格は前の世代の約半分です。

Googleは10月6日に最新の画像生成と編集モデルNano Banana 2.1を発表し、Geminiアプリ、Google検索のAIモード、Google Ads、Google AI Studio、Flow、Stitchなどの開発者ツールに導入しました。このモデルは、テキストの説明から画像を生成することができ、既存の写真を編集することも可能です。Googleは今回のアップグレードが3つの側面に集中していると述べています:視覚デザイン、マスクベースの編集(特定の領域をマークした後、その領域のみが変化する)および主体の一貫性、つまり人物や物体が何度も編集された後でも元の特徴を保持することです。文生図全体の好みテストにおいて、Nano Banana 2.1は1050 ELOポイントを獲得し、Nano Banana 2の990ポイントおよびNano Banana Proの935ポイントを上回りました。このモデルは最大で14枚の参照画像を同時に処理し、4つのキャラクターと10の物体を追跡し、最高4K、アスペクト比は最大8:1を出力します。開発者は生成前の思考時間を設定することができ、Google検索およびGoogle画像検索に基づいて事実確認を行うことができます。Google開発者APIを呼び出す際、標準1K画像の価格は0.0336ドルで、Nano Banana 2の0.067ドルの半分です;4K画像は0.0756ドルで、前世代は0.151ドル、バッチタスクではさらに50%割引が適用されます。上記の性能データはGoogle自身のテストに基づいています。

hot_img 噂によると、OpenAIは新しい画像モデルluna-lisa-alphaをテストしており、これはGPT Image 2.5の初期バージョンである可能性があります。

最近、多くのユーザーが luna-lisa-alpha という画像モデルが LMArena テストプラットフォームに登場したことを発見しました。これは OpenAI がテストしている新世代の画像生成モデルである可能性があります。公式な確認はされていませんが、外部では GPT Image 2.5 または次世代の GPT Image の初期バージョンではないかと推測されています。テストのフィードバックによると、新しいモデルはキャラクターの一貫性、画像のリアリズム、テキスト生成能力、およびノイズ制御の面で明らかな向上が見られます。一部のテスターは、これを GPT Image 2.0、Nano Banana Pro、Grok Imagine などのモデルと比較した結果、luna-lisa-alpha は複数回の生成において同じキャラクターの外観、衣装、スタイルをより良く保持できると考えています。しかし、複雑なテクスチャ領域には依然として繰り返しのテクスチャの問題があると指摘するテスターもいます。同日、OpenAI は GPT Image 2 API プレビューが透明な背景生成をサポートすることを発表しました。これは製品画像やウェブデザインなどのシーンで使用できます。複数のチェックポイント名の露出も、コミュニティが OpenAI が A/B テストを行っているのではないかと推測する要因となっています。このモデルが最終的に正式にリリースされるかどうかはまだ不確定で、OpenAI の公式情報を待つ必要があります。
app_icon
ChainCatcher Building the Web3 world with innovations.