詳細レポート
-
Kling Picture (Kling Picture バージョン) は、Kuaishou の Kling AI (Kling AI) プラットフォームの画像生成機能です。 Kling Video と同じオールインワン作成システムに属しています。 2026 年初頭に Keling 3.0 シリーズとともにリリースされる予定で、生画像、生画像、マルチ画像参照生画像、2K/4K 直接出力に重点を置き、映画やテレビレベルの物語的な画像と高い一貫性を重視しています。中国のクリエイターにとって、画質とリアリズムの点で、現在、国内の画像生成の第一の選択肢となっています。欠点は、無料割り当てが厳しく、生成速度が遅いこと、そしてスタイルの美学と迅速な単語の理解が依然として Dream や Midjourney に劣ることです。
-
Keling AI は、Beijing Kuaishou Technology Co., Ltd. によって開発されました。2024 年 6 月 6 日に正式にリリースされ、テストに招待されました。当初、Vincent Video と Tush Video の「映画レベルの画質」でデビューしました。このプラットフォームは、自社開発の拡散トランスフォーマー アーキテクチャと 3D 時空間共同注意メカニズムを採用しており、動的コヒーレンス、物理的信頼性、光と影のテクスチャに優れています。 2026 年の時点で、Keling AI は世界中で 2,200 万人以上のユーザーを抱え、合計 1 億 6,800 万本のビデオと 3 億 4,400 万枚の写真を生成し、Xiaomi や BlueFocus などの数万の企業にサービスを提供してきました。これは、国内の商業化において最も成功した AIGC ツールの 1 つです。 画像生成は、Keling 3.0 時代に完成できる重要なパズルのピースです。 2026 年 1 月 31 日、Keling AI は 3.0 シリーズ モデルをリリースしました。これは 2 月 5 日に正式に発売され (同日人民日報オンラインの報道)、3 月 5 日に全世界に完全公開されます。このシリーズには、KeLing Video 3.0、KeLing Video 3.0 Omni、KeLing Picture 3.0、および KeLing Picture 3.0 Omni の 4 つのコア モデルが含まれています。その中で、Keling Picture 3.0 は、技術的には Visual Chain of Thinking (vCoT) や Deep-Stack 視覚情報フローなどのメカニズムに依存し、2026 年 2 月初旬にオープンされる予定です。 Artificial Analysis の Wensheng Video ELO リストでは、2026 年 2 月 26 日に Keling 3.0 Pro がスコア 1240 で 1 位にランクされました。
-
Keling Pictures の中核機能は、「リファレンス駆動の一貫性の高い画像生成」を中心に展開しています。文生写真と土生写真をサポートしており、最大 10 枚の参考写真をアップロードできます。各絵の主な輪郭、核となる要素、トーンを正確にロックし、キャラクターの参照、ポートレートの参照、スタイルの転送、複数の絵の融合、部分的な再描画を実現します。参照画像内の要素を指定して、前後に切り替えることなく追加、削除、または変更できます。同関係者は、1月26日と1月31日の一貫性評価セットはそれぞれJimeng 4.5よりも優れていたと述べた。 画質に関しては、Keling Picture 3.0 は 2K/4K を直接出力でき、前世代と比較してリアリズムとディテールの一貫性が大幅に向上しました。また、新世代の「シリーズ画像」も備えており、映画やテレビのストーリーボード、プロットコンセプト画像、シーン設定画像、および一貫した視覚言語を必要とするその他のシーンに適しています。 Image 3.0 Omni モデルは、プロンプトワードのオーディオビジュアル要素を深く分解し、構図、光と影のトーン、シーンの変更、絞りのぼかしを正確に制御することにより、映画およびテレビレベルの物語イメージの表現をさらに強化します。 vCoT 推論は、レンダリング前にシーンの構造とフィルムの構成を分析し、フレーミング、視点、物語のロジックへの準拠性を向上させます。 ユーザーエクスペリエンスの点では、Web ページを開いてすぐに使用できます。 Discord に登録したり、科学的にインターネットをサーフィンしたりする必要はありません。中国語の説明を入力し、スタイルを選択して、「生成」をクリックします。画像は約 30 秒で生成されます。ただし、ユーザーは一般に、生成速度が Jimeng よりも遅いこと、画像生成後にローカルの詳細を最適化し続けることができないこと、これは Midjourney の「カード描画」プロセスに近く、複数回の再試行が必要であることを報告しています。
-
KelingはC側メンバーとB側APIの二輪駆動を採用しています。 C 側の無料バージョンには、基本的な毎日の生成数 (約 10 ~ 15 枚の写真、透かし付き、一部は制限されています) があります。有料メンバーシップは、ゴールド (約 19 元/月)、プラチナ (約 58 元/月)、ダイヤモンド (約 198 元/月) およびその他のレベルに分かれており、高画質、透かしの削除、高速化、およびより多くのクレジットのロックを解除できます。開発者 API はポイントまたはユニットによって課金され、イメージ モデルは「ユニット」によって価格設定されます。1 ユニット = 0.0035 米ドル: kling-image-v3 および kling-image-v3-omni Wenshengtu/tushengtu 1K および 2K は 8 ユニット (約 0.028 米ドル/イメージ)、4K は 16 ユニット (約 0.056 米ドル) 米ドル/イメージ)。 kling-image-o1 は両方とも 8 ユニットです。 kling-image-v2-1 は、Wensheng 写真の場合は 4 ユニット、Tusheng 写真の場合は 8 ユニットです。国内開発者パッケージはポイント販売となっており、Kling Image 3.0は1枚あたり0.2元(1K/2K)程度、4Kは1枚あたり0.4元程度となっている。
-
肯定的なコメントは、画質と中国人のフレンドリーさに焦点を当てています。多くのクリエイターは、Ling が作成した写真はディテールが豊富で、肌や素材の質感がリアルであると信じています。拡大しても印刷できるので、そのまま表紙や印刷物として利用できます。中国語のプロンプト単語の理解は明らかにミッドジャーニーよりも優れています。このウェブサイトは敷居がゼロで、価格は MJ よりもはるかに安いです。これは、公開アカウントのカバー、Xiaohongshu の写真、ビデオのカバーによく使われるツールです。 否定的な意見も集中しています。まず、無料割り当ては比較的少ないです。 1 日あたり約 100 ポイントは、10 ~ 15 枚の写真を撮影するのに十分なポイントであり、ポイントを使い切るには支払うか翌日まで待つ必要があります。次に、生成速度が遅く、1 枚の写真に 30 分から 1 分かかることがよくあります。第三に、漢字のレンダリングは Jimeng や DALL-E 3 ほど良くなく、中国風、高い美しさ、アジアの美学も Jimeng ほど良くありません。全体的なスタイルは「MJのベタベタ版/地味版」と評されており、プロンプトワードの理解力はJimengやDALL-Eに比べて弱い 3. MJ;第 4 に、ローカルな調整はできず、複数のカードを引く必要があります。第五に、時折構図の異常(余分な手など)があり、写実的なポートレートが不安定になります(指の変形、不自然な顔)。
-
業界は一般に、Koling を、Midjourney、Jimeng AI (Byte)、Tongyi Wanxiang (Alibaba)、DALL-E 3、Kolors と競合する、国内の画像およびビデオ生成における主要なプレーヤーであるとみなしています。その差別化は、中国の情景理解とビデオと画像の統合作成リンクにあります。同じ主題が写真からビデオを生成し、ビデオからコンセプト画像を推測することができ、テキスト→写真→ビデオ→継続→編集のワンストップ制作を形成します。サードパーティによる実際のテストでは、Keling はポスター、製品展示写真、リアルなスタイルの点で高いスコアを獲得しましたが、創造的な芸術性、スタイル ライブラリの豊富さ、テキスト レンダリングの点ではわずかに劣っていました。人民日報オンラインなどの権威あるメディアは、Keling 3.0 の一貫性における体系的な画期的な進歩 (キャラクター、アクション、サウンドがどのショットでも安定しており、テキストが鮮明で、ブランド ロゴが識別可能である) を強調しました。
-
主な論争は、製品の位置付けと機能の境界から生じます。 Kelingzhuブランドは依然としてビデオが得意です。強力な画像機能を備えていますが、特殊な写真生成ツールほど機能が豊富ではありません。ローカル編集ができないということは、きめ細かい写真を得るには Photoshop などのツールに戻る必要があることを意味します。無料クォータの強化や生成の遅延についても、特に写真をバッチで公開するときにエクスペリエンスの差が拡大する場合に、ユーザーからよく苦情が寄せられます。さらに、AI が生成した画像には、一般的な著作権および肖像権のコンプライアンス リスクが存在します。 Keling 当局は、商業認可とコンテンツの審査に関して、これに応じた制限を設けています。企業ユーザーは利用規約に注意する必要があります。
-
高い画質要件を持ち、中国のソーシャル メディア シーン (公的アカウント、Xiaohongshu、Douyin のカバーや写真、電子商取引製品の表示写真、映画やテレビの絵コンテ、コンセプト アートなど) を志向するクリエイターに最適です。初心者でも使いやすく、敷居ゼロで使える写真が作れます。究極の芸術的なスタイルを追求する場合、または頻繁に局所的な洗練が必要な場合は、Midjourney または Jimeng と併用することをお勧めします。予算がゼロで時々写真を作成する場合は、まず Keling の無料割り当てを使い切ってから、Jimeng サプリメントに切り替えることができます。実用的な組み合わせは、毎日のイラストには Keling、高品質のブランド素材には Midjourney、テキスト付きの宣伝ポスターには DALL-E 3 です。
-
Keling Picture Edition は、Kuaishou のビデオレベルの一貫性機能を静止画像に移した結果です。その画質と中国語への親しみやすさは中国トップクラスであり、中国のコンテンツクリエイターの日常的な高品質な映像制作に適しています。欠点は、無料割り当てが厳しいこと、速度が遅いこと、ローカル編集ができないことです。 「メイン画像制作+その他の隙間を埋めるツール」の組み合わせの一員として利用するのがおすすめです。
ユーザーレビュー
-
DennisRogers_7—国风和高美感的图确实不如即梦,整体风格有点偏「油腻版 MJ」,提示词理解也比即梦弱一些。 -
Linda_Cook_2020—我做的是电商产品图,以前拍一组场景图又要布光又要后期,现在把白底产品图丢进可灵,让它生成放在咖啡桌、阳台、办公室里的展示效果,出来的图很自然、光影也合理,比手动精修快了不止一个量级,小团队出图神器。 -
AnthonyGarcia_2021—做公众号封面和小红书配图基本都靠它,我之前用别的工具出图总得调好几轮,可灵出来的图构图中规中矩、色调也舒服,基本能直接当封面用,不用二次修图,对每天都要固定产出的自媒体人来说真的省了不少事。 -
BaturKaplangı—多图参考生图这个功能很实用,我做一次角色 IP 的系列图,上传几张参考图就能精准锁住角色轮廓、配色和服饰基调,换姿势换场景都不再跑偏,做漫画分镜和品牌视觉的一致性比之前手工调参强太多,整体效率明显上来了,省心不少。 -
HAcha_fi—本地化做得好,和视频生成打通,先出图再一键转视频,文→图→视频一条龙,做短视频素材特别顺手。 -
KyleBennettQ—中文字渲染还是不如即梦和 DALL-E 3,图里想生成清晰的标题文字经常会糊,做带字海报得后期再补。 -
GaryWilliams—中文提示词理解比 Midjourney 强太多,不用翻译成英文再喂,写大白话它也能 get 到,对新手很友好。 -
Frances.Lopez_2023—价格还算友好,比 Midjourney 便宜不少,我上个月用量大概花四五十块,日常够用了。 -
8abd73qupx—生成速度偏慢,一张图经常要等半分钟到一分钟,批量出图的时候这个差距会被放大,比较磨人。 -
BUlew—整体是国产里最均衡的生图选手,画质天花板高、中文友好、价格也低;短板是额度紧、速度慢、不能局部精修。我的务实用法是日常配图交给可灵,高质量品牌素材用 Midjourney,需要图里带清晰文字的促销海报就交给 DALL-E 3,三个工具各取所长,基本能覆盖全部场景。 -
竹影698—不能局部调整是个痛点,出了图只能整张重抽,想改个细节得重新跑,效率上比能精修的工具吃亏。 -
HJenkinsQ—可灵的图片质量确实能打,我拿同一句提示词分别跑了可灵、即梦和 Midjourney 做对比,结果可灵出的图在皮肤纹理、材质质感和光影真实感上明显更胜一筹,放大看细节也不崩,直接就能当封面用,不用再开 Photoshop 二次修图,省了我不少后期时间。 -
J_anetAnderson—网页打开就能用,不用挂梯子也不用学 Discord,这点对国内用户真的很友好,入门零门槛。 -
Lauren.Flores—免费额度太少了,每天就一百积分,大概十来张就没了,用完只能等第二天,重度用户根本不够用。 -
Jerry_Mitchell_2023—偶尔会出构图翻车的情况,比如多出来的手或者手指变形,写实人像的稳定性还有提升空间。