Tencent Hunyuan

腾讯公司全链路自研的通用とマルチモーダル大規模モデル家族,覆盖文本、图像、视频、3D等模态

詳細レポート

  • Tencent Hunyuan Large Model (Tencent HY) は、Tencent が独自に開発したユニバーサルでマルチモーダルな大型モデルのファミリーであり、2023 年に正式にリリースされる予定です。このモデルは、テキスト、画像、ビデオ、3D およびその他のモードをカバーし、クロスドメインの知識と自然言語理解機能を備えています。 Tencent Hunyuan は、高品質のコンテンツ作成、数理論理学、コード生成、マルチラウンド対話において優れたパフォーマンスを発揮し、業界をリードするレベルにあります。 Tencent の AI 戦略の中核製品として、Hunyuan Big Model は企業開発者と個人ユーザーに、モデルの呼び出しからアプリケーションの展開までのフルリンク サポートを提供します。

  • Tencent Hunyuan の大型モデルは Tencent によって独自に開発されており、チームは Tencent Cloud Business Group に所属しています。このプロジェクトは 2022 年に開始され、大規模なデータ トレーニングを経て 2023 年 3 月にデビューし、その後も繰り返しアップグレードを続けました。 Tencent Hunyuan は、パラメーターが数兆に達する Transformer アーキテクチャを採用しており、中国最大の言語モデルの 1 つです。 企業の戦略的観点から見ると、Tencent Hunyuan は Tencent の AI レイアウトの中核となる機能です。 2025 年以降、テンセントは AI 製品ラインをさらに統合し、「Hunyuan の大型モデルは基盤となる AI 機能を提供し、Yuanbao はクラウドベースのインテリジェントな対話を可能にし、QClaw はローカル AI の実行に重点を置いている」という 3 つの製品マトリックスを形成しています。 Tencent Hunyuan は Tencent の社内ビジネス (WeChat、QQ、ゲームなど) にサービスを提供するだけでなく、Tencent Cloud を通じて外部の企業顧客に API 呼び出しサービスも提供します。 Tencent Hunyuan 氏は、テクノロジーの研究開発に関して、リンク全体が自律的かつ制御可能であり、トレーニング前のデータ構築、モデル アーキテクチャの設計からトレーニングと推論のプロセスに至るまで、すべてが独立して完了することを強調しています。これにより、他の大手国内模型メーカーの技術路線との差別化された競争が生まれます。

  • Tencent Hunyuan は豊富なモデル機能とアプリケーション ツールを提供しており、これらは主に次のモジュールに分かれています。 フンユアン・シェンウェン 自然言語対話に基づいて関連性のあるテキスト コンテンツを出力し、テキストの生成、作成、質疑応答、その他のシナリオに適しています。この機能は、文学作品の作成、テキストの要約、継続などの作業に適しています。最大コンテキスト長 256K をサポートし、超長いドキュメントを処理できます。コード生成に関しては、Hunyuan は複数のプログラミング言語をサポートしており、コード補完、デバッグ、注釈などのタスクを完了できます。 テンセント・フンユアン・シェントゥ Hunyuan Wenshengtu 大型モデルに基づいており、強力な中国語理解と画像生成機能を備えています。文字による記述で賢く美しい絵を描くことができ、さまざまなスタイルやシーンに対応します。この機能は中国語のプロンプト単語の理解精度が高く、生成される画像は類似製品よりも詳細な性能に優れています。 テンセント・フンユアンシェンのビデオ Tencent のビデオ生成ラージ モデルおよびその他のテクノロジーに基づいて、高品質のビデオ コンテンツの生成または処理をサポートします。この機能はビデオ作成やショートビデオ生成などのシナリオに適用でき、文盛ビデオや土盛ビデオなどのさまざまなモードをサポートします。 2026 年 4 月、テンセントは Hunyuan 3D World Model 2.0 をリリースしてオープンソース化し、3D コンテンツ生成機能をさらに強化しました。 テンセント・フンユアンシェン 3D Hunyuansheng 3D 大型モデルに基づいて、入力されたテキストの説明を組み合わせたり、2D 画像をアップロードしたりすることで、3D モデルを迅速に生成できます。この機能は、業界初のワンストップ 3D コンテンツ AI 作成プラットフォームであり、Vincent、Tusheng 3D、3D アニメーション生成などの複数の機能をサポートしています。 混合要素マルチモーダル 画像の入力をサポートし、画像の理解、画像の作成、複数ラウンドの対話、分析的推論、その他の機能を含む、会話内のテキストを生成します。ユーザーは画像をアップロードし、画像の内容について質問することができ、モデルは画像内のオブジェクト、シーン、テキスト情報を正確に識別できます。 機種仕様 Tencent Hunyuan は、次のような複数のバージョンのモデルを提供しています。 Tencent HY 2.0 Think: 深い推論モデル、最大 128K 入力、64K 出力、強力な数学的能力、複雑なタスク分析に適しています Tencent HY 2.0 命令: 素早い思考モデル、最大 128K 入力、16K 出力、文化的および創造的な執筆に非常に実用的 Hunyuan-large-role: ロールプレイング モデル、最大 28K 入力、4K 出力、優れた詳細な対話機能 エンタープライズ アプリケーション レベルでは、Tencent Hunyuan は、大規模モデル サービス プラットフォーム TokenHub、エージェント開発プラットフォーム ADP、ナレッジ エンジン LKE などを含む完全なアプリケーション開発ツール チェーンを提供します。これらのツールにより、企業が大規模モデルを使用する敷居が低くなり、ユーザーは AI アプリケーションを迅速に構築できます。

  • Tencent Hunyuan は、主に次のような柔軟な請求モデルを採用しています。 請求方法 プリペイドリソースパッケージ:ユーザーは事前にトークンの使用量を購入し、価格は比較的有利で、安定した使用量の法人顧客に適しています 後払い日払い決済:決済手数料は日割り計算され、ご利用量の変動が大きいお客様や初めてご利用されるお客様に最適です。 新規ユーザー割引 新規ユーザーは、独占的なリソース パッケージをお楽しみいただけます。テキスト生成モデルには 100 万トークンが無料で共有され、埋め込みモデルには 100 万トークンが独占され、購入日から 1 年間有効です。このポリシーにより、新規ユーザーの試用しきい値が大幅に引き下げられます。 エンタープライズレベルのサービス Tencent Cloud は、最初の 1 か月間無料トライアルをサポートするエンタープライズ レベルの AI エージェント ソリューションを提供し、10,000 クレジット + 1 GB ナレッジ ベース ストレージを受け取ることができます。企業は、自社のニーズに応じてプライベート展開またはクラウド通話を選択できます。 市場ポジショニングの観点から、Tencent Hunyuan は主に企業顧客をターゲットとしており、モデルの呼び出しからアプリケーションの展開までのワンストップ サービスを提供しています。これにより、個々のユーザーに対して、ChatGPT、Wenxinyiyan などとの差別化された競争が形成されます。

  • 正のフィードバック インターネット上の公開情報によると、Tencent Hunyuan はユーザー グループの間で好意的な評価を受けています。主に次の側面に焦点を当てます。 中国語の理解能力に関しては、Tencent Hunyuan は中国語の文脈、慣用句、ことわざをより正確に理解しており、生成されるコンテンツは中国語の表現習慣に準拠しています。これは国内の企業ユーザーにとって重要な利点です。 エンタープライズ アプリケーション シナリオに関しては、Tencent Hunyuan と Tencent Cloud 製品システムの緊密な統合が独自の利点です。ユーザーは Tencent Cloud 上で Hunyuan の大型モデルをシームレスに使用できるため、テクノロジーのドッキング コストが削減されます。 応答速度の点では、Tencent Hunyuan の推論速度は業界の上位中レベルにあり、ほとんどのリアルタイム アプリケーション シナリオのニーズを満たすことができます。 否定的なフィードバック 同時に、一部のユーザーからは次のような批判の声も上がりました。 マルチモーダル機能に関しては、Tencent Hunyuan の画像およびビデオ生成機能とプロ仕様の AI ペイント ツール (Midjourney や Stable Diffusion など) の間にはまだギャップがあると考えるユーザーもいます。 オープン性の観点から言えば、Tencent Hunyuan は主にクローズド ソース API の形式でサービスを提供しており、オープン ソース バージョンは少ないため、学術研究やコミュニティ イノベーションの余地が限られています。 価格に関して、一部の中小企業ユーザーは、特に大規模に適用する場合、トークンベースの課金モデルの方が高価であると考えています。

  • メディアの意見 国内テクノロジーメディアは総じてテンセント・フンユアンに対して肯定的な評価をしている。 Geek Park や 36 Krypton などのメディアは、Tencent Hunyuan が国内の大型モデル市場における重要なプレーヤーであると信じており、Tencent Hunyuan の最新版について繰り返し報道してきました。 Tencent Hunyuan の中国語理解や数学的推論などのタスクにおけるパフォーマンスは、何度も肯定的に評価されています。 2024年から2025年の主要評価リストにおいて、騰訊渾源は国内大型モデルの上位ランキングに何度もランクインし、百度文信宜燕、バイト豆宝、芝浦GLMなどと競争パターンを形成している。 競争環境 国内大型モデル市場の競争は熾烈を極めている。 Tencent Hunyuan の主な競合他社は次のとおりです。 Baidu Wenxinyiyan: 中国で発売された最も初期の大規模モデルの 1 つで、検索とナレッジ グラフに深い蓄積がある Bytedance Doubao: ByteDance エコシステムに依存しており、コンテンツの推奨や短いビデオのシナリオにおいて独自の利点があります。 GLM: 清華大学技術チームの経歴、学術研究およびオープンソース コミュニティにおいて高い影響力 Alibaba Tongyi Qianwen: アリババによって開始され、電子商取引および金融シナリオでのアプリケーションの利点があります。 Tencent Hunyuan の差別化された利点は、Tencent のエコシステムとエンタープライズ サービス分野での深い蓄積の相乗効果にあります。

  • データセキュリティに関する論争 Tencent の製品として、Tencent Hunyuan のデータ処理およびプライバシー保護ポリシーは注目を集めています。 API サービスを使用する際、ユーザーは Tencent Cloud サーバーにデータをアップロードする必要があるため、一部の企業はデータのセキュリティを懸念しています。テンセントは、厳格なデータセキュリティ対策を採用していると述べたが、具体的な技術的詳細の公開は限られている。 コンテンツコンプライアンスのリスク 大規模なモデルでは不適切なコンテンツが生成される可能性があるため、Tencent Hunyuan はコンテンツ セキュリティ レビュー メカニズムを導入しました。しかし、ユーザーの規模が拡大するにつれて、違法なコンテンツを効果的に防止およびフィルタリングする方法は引き続き課題となっています。 テクノロジー依存のリスク 企業ユーザーが単一モデルのサプライヤーに過度に依存すると、事業継続のリスクが生じる可能性があります。 Tencent が将来 API の価格やサービス条件を調整した場合、ユーザーの移行コストはさらに高くなるでしょう。

  • ユーザーに適した Tencent Hunyuan は次のユーザー グループに適しています。 エンタープライズ ユーザー: AI 機能をビジネスに統合する必要があるエンタープライズ開発者、特に既存の Tencent Cloud エコシステムを備えた企業 コンテンツ作成者: 中国語コンテンツの作成に支援が必要なライター、編集者、マーケティング担当者 開発者: アプリケーション開発のために大規模なモデル API を呼び出す必要がある技術担当者 研究者:大型モデル技術の研究ニーズがある大学および科学研究機関 ユーザーには適さない 画像/ビデオ生成品質に対する非常に高い要求を持つユーザー (プロ仕様の AI ペイント ツールを選択することをお勧めします) 完全なオープンソース モデルを必要とする開発者 (LLaMA や Qwen などの大規模なオープンソース モデルを検討することをお勧めします) データプライバシーに関して非常に厳しい要件を持つユーザー (民営化された導入ソリューションを検討することをお勧めします) 代替品 Tencent Hunyuan が需要に対応できない場合は、次の代替製品が検討されます。 テキスト生成: OpenAI GPT、Anthropic Claude、Baidu Wenxinyiyan、Zhipu GLM 画像生成: Midjourney、安定拡散、DALL-E、Leonardo AI オープンソース モデル: LLaMA、Qwen、Baichuan、ChatGLM

  • Tencent Hunyuan は、Tencent が自社開発したすべてのリンク向けのユニバーサル大規模モデルです。中国語理解、マルチモーダル生成、エンタープライズサービスにおいて競争上の優位性を持っています。 Tencent のエコシステムの相乗効果に依存する Hunyuan の大規模モデルは、エンタープライズ アプリケーション シナリオにおいて独自の価値を持っています。ただし、オープン性やコミュニティ構築などの面ではまだ改善の余地があります。国内企業ユーザーにとって、Tencent Hunyuan は検討に値する大規模なモデルの選択肢であり、既存の Tencent Cloud エコシステムを持つ企業に特に適しています。

ユーザーレビュー

  • 头像
    tiflyrn
    说个大部分人没注意的点,Hy3在WorkBuddy里其实有俩独立旋钮,一个是Max模式一个是思考强度,好多人压根没开过Max,白瞎了。我自己试下来,平时闲聊挂低档,唰一下就出结果快得像外卖;真遇到烧脑的动态规划题再拨到高档,它会闷头想个十几秒,过程写得跟老师板书似的基本不翻车。免费期内消耗倍率显示0x,随便造不扣额度,这波是真舍得。

  • 头像
    松涛496
    免费的谁不爱啊,冲!

  • 头像
    WilliamButler520284
    微信小程序那个「成长计划」直接送10亿token加10万张生图,有效期六个月。按1元每百万token算差不多值一千块,国内单笔最大的免费AI额度了吧,反正我是没见人反驳。

  • 头像
    Russell_BrooksK11
    元宝现在能直接跑Agent了,一句话丢过去它把PPT、Word、Excel、PDF全给你交付,还全免费,日常办公够用了。

  • 头像
    FRichardsonJr
    提醒一句薅羊毛的兄弟,WorkBuddy上Hy3限时免费是7月6到22号,就剩没几天了。这感觉就跟便利店关东煮快收摊、店员喊最后五分钟半价一样,手里还攥着空碗的赶紧上。真别等收费了才想起来当初有免费窗口,到时候拍大腿都来不及,尤其那些一直想跑又舍不得耗积分的复杂任务,趁现在。

  • 头像
    Frank.Johnson_773
    别的都还行,数学是真的弱,MathArena那分数不到GPT5.5一半,硬核推理别指望它。

  • 头像
    Jacob.Mendoza
    定价是真狠,输入1块输出4块每百万token,命中缓存才两毛五。高频办公场景token消耗比GLM5.2低了快一半,文档处理省47%、做PPT省49%,成本敏感的小团队闭眼选。

  • 头像
    M_Anel
    Apache 2.0开源,商用零门槛,格局打开了。

  • 头像
    DeborahBarnes_20233
    编程实测说下,SWE-bench Verified 78分,在开源模型里算第一梯队了,日常写写业务代码完全够。但你要跟Claude Opus或者GPT5.5那种顶级闭源比,硬核工程和复杂推理还是差口气,SWE-bench Pro就掉到快60了。定位很清楚,性价比选手,不是全能王。

  • 头像
    MargaretMurray00779
    最惊喜的是幻觉率,从12.5%降到5.4%直接砍一半,常识错误也少了很多,写东西不敢说全对但至少不会一本正经胡编了。

  • 头像
    Sara_Butler_2024
    OpenRouter上能免费调API,实测吞吐能到150+ tokens/s,跑Agent任务体感很顺。

  • 头像
    bluekoala971
    混元总算坐上牌桌了,不容易。

  • 头像
    LydiaCox_X
    正式版今天发了,综合用了一天说下真实体感。办公Agent和搜索类任务确实能打,BrowseComp都84分了跟GPT5.5几乎持平,元宝那边输入需求直接给你交付PPT和Word这种体验很爽。但它是个明显的「偏科生」,先把最实用的场景做透,复杂数学和硬核代码就一般。我的结论是,如果你是创业者或者中小团队,日常文档、搜索、办公这些场景Hy3能力和GPT5.5基本持平,但成本只有人家几十分之一,加上限时免费和开源,试错成本几乎为零,真没理由不试。追求极致推理的可以再等等下一版。

  • 头像
    KAllen_7728
    preview用了两个月了,正式版啥时候出啊,蹲一个。

  • 头像
    Michelle.Ruiz_202339
    元宝在综合办公和生活服务这块,体验已经超过GLM5.1这些国产模型了,关键是全免费开放,降门槛这事儿腾讯是真在做。

  • 头像
    IsaiahBennett
    生态铺得是真开,Github、HuggingFace、ModelScope、GitCode同步放权重,海外OpenRouter、Cline、Cherry Studio也都能接,用啥工具链都够得着。

  • 头像
    DMyers
    混元这个Hy-MT2翻译模型有点东西,支持33种语言互译,7B和30B在翻译任务上是开源最佳,最离谱的是那个1.8B的小模型居然超过了微软和豆包的商业API,量化完才440MB能塞手机里本地跑。

  • 头像
    JudyJohnson_Pro97
    腾讯Hy翻译小程序上线了,能本地推理这点对经常出国没网的人挺实用的~

  • 头像
    PMurray_2022
    客观说下preview这一个多月的体验,工具调用稳定性是肉眼可见地好了,以前动不动调用失败得手动重试,现在成功率高多了,错误还能自己恢复。长对话也不容易断片,前面交代的约束到后面基本还接得住。中文理解一直是它的强项,跟中文语境很合拍,腾讯生态里微信QQ企业微信直接能用入口方便。缺点也有,一些高级功能得企业认证,创意写作偏保守放不太开。

  • 头像
    Keith.FloresSr
    比Hy2强了不止一个档次,飞跃式的。

  • 头像
    cRYPTOmAX
    preview上手简评,体感性能跟MiniMax差不多,但跟Kimi K2.6或者GLM 5.1比还是有差距的,考虑到它295B总参数21B激活的MoE架构,这表现基本符合预期,先追平第一梯队的上一代吧。

  • 头像
    Gary.RobertsSr
    preview刚上手,MoE输出速度是真快,就是感觉还得再练练。

  • 头像
    IRivera_8880
    今天这个preview是姚顺雨接手大模型业务后的首个模型,意义不一样。跟自家前代Hy2一对比,进步可以说是飞跃性的,等于完成了从「无法上桌」到「能坐上牌桌」的关键一跃。对内也意味着元宝这些产品终于有了更可靠的自研底座,战略意义挺大的,大模型竞赛是马拉松不是百米冲刺,这一版是个非常好的开始,期待下一个版本。

  • 头像
    Danielle.Sanders_2020
    腾讯混元3D世界模型2.0发布了,一句话就能生成完整的3D空间资产,这技术迭代速度太快了!

  • 头像
    NAbzo
    用了三个月的混元T1,说实在的日常办公写文案足够了,响应速度比GPT还快

  • 头像
    Billy824
    强烈推荐混元4.0 Turbo,生成的图片质量提升明显,关键是中文理解能力甩开其他模型一大截

  • 头像
    蝴蝶_21
    混元大模型在LMArena盲测登顶第一,80B参数开源商用,确实给国产大模型长脸了

  • 头像
    CosmosCowboyAndersen
    企业用户表示很香,接入腾讯云API很方便,文档也很完善

  • 头像
    RobertKing_9918
    说实话比文心一言好用,特别是代码生成方面

  • 头像
    GTorres_2024
    新用户100万token白嫖真香定律,适合前期测试