アリババが自社開発したAI推論チップがリリース、Hanguang 800は他のチップより10倍強力

アリババが自社開発したAI推論チップがリリース、Hanguang 800は他のチップより10倍強力

[51CTO.comよりオリジナル記事] 9月25日、DAMOアカデミーの張建鋒学長は杭州雲奇カンファレンスでHanguang 800 AI推論チップのテープアウトを実演しました。業界標準のResNet-50テストでは、Hanguang 800は推論性能78,563 IPSを達成し、これは現在の業界最高のAIチップの4倍に相当します。エネルギー効率比は500 IPS/Wで、2位のチップの3.3倍です。「Hanguang 800は、アリババのチップ分野における長い行進の第一歩です。」

[[277873]] [[277874]]


Pingtou Geは昨年の雲旗カンファレンスで発表されて以来、過去1年間にXuantie 910とWujian SoCプラットフォームをリリースし、本日Hanguang 800チップをリリースしました。この一連の新製品の発売は、アリババのPingtou Ge製品ラインが形を整えたことを意味し、現在はプロセッサIP、ワンストップチップ設計プラットフォーム、AIチップをカバーし、チップ設計チェーンの完全なカバレッジを実現しています。

Hanguang 800とは何ですか?

Hanguang 800は推論に重点を置いたAIチップです。人工知能チップの差別化された設計は主にハードウェアアーキテクチャとソフトウェアアルゴリズムに反映されるため、チップの価値を最大化するには、この2つを高度に適応させる必要があります。現状から見ると、従来のCPUとGPUはディープラーニング推論タスクにおいてハードウェア能力を十分に活用できていません。たとえば、GPUアーキテクチャは主に画像処理用に設計されており、そのハードウェア構造とソフトウェアエコシステムはほぼ固定化されているため、AIタスクを深く最適化することは困難です。

パフォーマンスはどうですか?

Hanguang 800のチップアーキテクチャに関しては、革新的なアーキテクチャを採用しています。ディープラーニングで使用される大量の重みパラメータとテンソルデータに対して、スパース圧縮と量子化処理をサポートし、独自に設計されたデータアクセスとパイプライン処理技術を使用して、I/O要件とデータ移動を大幅に削減します。 NPU は畳み込み、行列乗算、ベクトル計算、およびさまざまな活性化関数も徹底的に最適化します。高効率のハードウェア リソース スケジューリングと完全に並列化されたデータ ストリーム処理により、AI コンピューティングのパフォーマンスとエネルギー効率を最高レベルに押し上げます。Hanguang 800 のパフォーマンスの飛躍的進歩は、ソフトウェアとハ​​ードウェアの共同イノベーションによるものです。

アルゴリズムの面では、アリババDAMOアカデミーのマシンインテリジェンス研究所は、過去2年間で音声インテリジェンス、言語技術、マシンビジョン、意思決定インテリジェンスなどの分野をカバーする完全なアルゴリズムシステムを構築し、多くの高レベルの成果を達成しました。ハードウェアの面では、アリババはサーバー、FPGA、ストレージの分野で長年の研究開発経験を持っています。さらに、Pingtou Ge技術チームは、アーキテクチャ、コンパイル技術などの分野で深い技術的蓄積を持っています。

1 つの Hanguang 800 チップ = 10 個の GPU


Hanguang 800のデータ性能は非常に優れています。現地の基調講演のデータによると、Hanguang 800 1個の性能はGPUの約10倍で、エネルギー効率比は500IPS/Wに達します。製造プロセスも12nmを採用し、トランジスタ数は170億個に達します。編集者は、同様のAIチップと比較した後、Pingtou GeのHanguang 800チップも業界で比較的リードしているという結論に達しました。

[[277875]]


漢光800理論性能データチャート

実際のパフォーマンス

Hanguang 800は現在、アリババのコアビジネスで使用されています。雲斉会議での現地デモンストレーションによると、杭州市主要都市の都市脳における交通ビデオのリアルタイム処理には、従来は300msのレイテンシを持つGPUが40個必要だったが、Hanguang 800を使用するとGPUが4個しか必要なくなり、レイテンシは150msに短縮された。また、皆さんがよく使っている Pailitao 製品が高速なのも、Hanguang 800 の性能のおかげです。Pailitao 製品ライブラリには毎日 10 億枚の製品画像が追加され、従来の GPU コンピューティング能力では認識に 1 時間かかりますが、Hanguang 800 では 5 分に短縮できます。

まとめ:
Hanguang 800の価格はまだ発表されていませんが、この高性能チップはコストパフォーマンスに優れた製品になると信じています。また、Pingtou Geによる一連のチップのリリースは、国産チップにとって大きな進歩を意味します。近い将来、より多くのコストパフォーマンスに優れた国産チップが登場することを期待しています。

[51CTO オリジナル記事、パートナーサイトに転載する場合は、元の著者とソースを 51CTO.com として明記してください]

[編集者:張斌 TEL: (010) 68476606]

<<:  2019 年のトップ 5 ディープラーニング コース

>>:  アリババ初のAIチップ「Pingtou Ge」が発売! NVIDIA P4 より 46 倍高速で、推論パフォーマンスの世界新記録を樹立

ブログ    
ブログ    
ブログ    

推薦する

南洋理工大学の最新の視覚言語モデルの概要:事前トレーニング、転移学習、知識蒸留

コンピュータ ビジョン (CV) 研究における長年の課題として、視覚認識 (画像分類、オブジェクト検...

よく使われる8つのソートアルゴリズム - Javaコード実装

1. バブルソート改良版: 2. 選択ソート3. 挿入ソート4. シェルソート5. クイックソート6...

データが増えるほど、AI は賢くなるのでしょうか?私たちはそれを常に当然のこととして受け止めてきました。

人工知能技術の台頭に伴い、AIの問題点が徐々に明らかになってきました。 AI による決定は、依然とし...

ビジネスに AI を導入する 3 つのユースケース: CxO 向けチートシート

[[354085]]人工知能 (AI) はもはや初期段階ではなく、影響力のある結果をもたらす重要なビ...

能力が高くても給料が高くならない?これらの考えはあなたに合うでしょう

2019年ももうすぐ終わり。何もなかったこの一年を振り返って、最も給与が高い職種はどれでしょうか?ア...

AIロボットが産業監視を強化

この機会に応えて、IBM と Boston Dynamics は協力して、IBM ソフトウェアと B...

75歳のヒントン氏が再び警告:AIが人間を支配するかもしれない!

10月9日、ヒントン氏は「60 Minutes」のインタビューを受け、人工知能が人間を支配するかも...

AIは雇用を奪うのか、それとも雇用を生み出すのか?

人工知能は、職場環境で参照される場合、複雑な感情と視点をもたらします。同僚、友人、または見知らぬ人に...

AIが建物の運営に及ぼす影響

昨年、ChatGPT とその他の AI 搭載サービス エンジンがリリースされて以来、このテクノロジー...

...

...

杭州市の100以上の交差点で無人信号制御が実現し、杭州シティブレイン1.0が正式にリリースされました

10月11日、アリババは2017年杭州雲奇大会で、人類のテクノロジーの未来を探求する実験室「大墨学院...

Hubo Technologyが「2019年グローバルフィンテックイノベーションTOP50」に選出されました

最近、世界をリードするインテリジェント金融検索エンジンであるHubo Technologyが「201...

スマートヘルスケアは急速に普及しつつあり、さまざまなスマートテクノロジーが好まれている

人々の生活の重要な分野として、医療産業の発展は大きな注目を集めています。現在、医師の診察の難しさや高...

スマートホームのヒューマンマシンインターフェース (HMI) におけるエッジ AI

消費者は、利便性、安全性、ユーザーエクスペリエンスを向上させる進歩を飽くなき欲求で求めています。ヒュ...