「HBM」を含む日記 RSS

はてなキーワード: HBMとは

2026-08-05

anond:20260805105430

DDR4AIとか無理だよ。遅すぎて使い物にならない。



AIHBMってメモリを使う。HBM普通PCじゃ使えない。HBMは専用サーバーとセットで使うもので、AIには必須必須から高く売れる。



からメーカーDDR製造を止めてHBMを作るようになった。結果、今、DDRが不足してるんだわ。

anond:20260805153600

LPDDRDDRの違いではなくパッケージングの違い。

M4チップは最速でも8533 MT/sのLPDDR5Xを使用して546GB/sの帯域になる。

これは128Bitバスを4本束ねて利用するというパッケージングによって達成している。

自作PC向けのメモリ帯域が遅いのはIntel Z890でもバス幅が合計128Bitしかないため。

546GB/sという数値も機械学習の推論で使うには非常に遅く、その辺のグラボに負ける始末。

最近HBMメモリでも8000 MT/s程度という速度は変わらないが2048 bitバス幅があり、

これによって数TB/sという速度を達成している。

従ってパッケージングを除いて考えたときに、LPDDR5XがDDR5と比較して特にLLM向きとは呼べない。

2026-08-01

走れapple

Apple激怒した。

必ず、かの邪智暴虐のマイクロンを除かなければならぬと決意した。

Appleにはメモリ相場がわからぬ。Appleは、クパチーノ製品である

アルミを削り、端子を減らし、昨日まであった機能革新として売って暮らしてきた。けれども、部品単価の上昇に対しては、人一倍に敏感であった。



きょう未明調達部門から報告が届いた。

マイクロンが、また値上げを申しております

「なぜ上げる」

AI需要でございますHBMが足りず、DRAMNANDも市況が締まっていると」

Appleは黙った。AI需要という言葉は、近頃あらゆる値上げを正当化する魔法呪文になっていた。



「われわれもAIをやっている」

はい

「ならば、われわれには安く売るべきではないか

調達担当者は答えなかった。論理が通っていないからではない。Appleにおいて、通っていない論理ほど強く通ることを知っていたかである

Appleは立ち上がった。

サプライヤー分散する。サムスンを呼べ。SK hynixにも声をかけろ。キオクシアには、まだ空きがあるか聞け」

しかし、品質認証には時間がかかります

時間はつくるものだ」

製造能力は、つくれません」

Appleは、いよいよ激怒した。

「ではマイクロンに伝えよ。われわれには、他の選択肢があると」

担当者は静かに尋ねた。

「実際に、ございますか」

会議室に、長い沈黙が落ちた。

窓の外では、巨大な環状本社が夕日に照らされていた。その美しい輪は、完全なエコシステム象徴であると同時に、逃げ道のない円環にも見えた。



Appleは低い声で言った。

選択肢があるように見せることも、選択肢の一つである

かくしてAppleは、マイクロンとの価格交渉に赴くこととなった。手には長期購入契約、背には次期iPhone生産計画、胸には粗利益率を抱いて。

ただしAppleは、まだ知らなかった。

マイクロンもまた、同じころ会議室で言っていたのである

「嫌なら、他から買えばよい」と。

anond:20260717210220

追加情報:8GBが64GBになった。祭りが始まっている

その後、状況がかなり進んだ。

CMP 170HX 8GB版を64GBとして認識させ、実際にモデルを読み込んで推論や学習を走らせる報告が複数出ている。

しかも1枚だけではない。

64GB化した170HXを2枚使い、

  1. 合計128GB
  2. vLLM
  3. llama.cpp
  4. Tensor Parallel
  5. Pipeline Parallel

まで試している人が現れた。

もう「nvidia-smiに64GBと表示された」という段階ではない。「128GBをどう分割すると一番速いか」を測り始めている。

年初の3万7,500円は完全に祭りだったが、現在のAlibaba相場は1枚1,250ドル前後

1ドル150円なら約18万7,500円。2枚で約37万5,000円である

送料、母艦、電源、冷却を含めれば50万~60万円程度にはなるだろう。それでも、CUDAで使える64GB HBMGPUが2枚手に入る可能性がある。

何かがおかしい。

普通にCUDAで128GBを用意すると

比較対象として分かりやすいのはRTX A6000 48GBだろう。

同じNVIDIAのAmpere世代で、CUDAが使え、AI業務用途向けに48GBの独立VRAMを搭載している。

128GBを超えるには3枚必要になる。

48GB×3枚=144GB

現在国内中古相場を1枚50万~60万円程度とすると、3枚で150万~180万円。新品ならさらに高い。

対してCMP 170HXは、現在相場でも2枚約37万5,000円。

中古A6000を3枚買う場合と比べて、カード代だけで100万円以上違う。

もちろん、170HX×2がA6000×3と同等だという話ではない。

A6000は正式製品で、PCIe Gen4 x16、画面出力、安定したドライバ製品保証がある。3枚ならVRAMも144GBあり、演算能力も3枚分になる。

170HXは64GBが2枚に分かれ、PCIeが遅く、冷却もドライバ自分で面倒を見る必要がある。

比較しているのは性能ではなく、「CUDAで100GBを超えるVRAMを用意するには普通いくらかかるか」である

そこだけを見ると、170HXの値段は明らかにおかしい。

完成品との比較

大容量メモリを持つ完成品としては、Mac StudioやDGX Sparkのような選択肢もある。

大容量構成は100万円級になるが、静かで省電力で、箱から出せば動く。

ただし、これらはCPUGPUが同じ領域を使う統合メモリで、170HX×2の「独立した64GB VRAMが2枚」とは構造が違う。単純な性能比較はできない。

比較できるのは、「巨大モデルローカルに置くためにいくら払うか」という一点だけである

完成品に100万円を払うか、50万~60万円程度で怪しい中古カードを組み上げ、自分保守担当になるか。

その差である

何が面白いのか

64GB化された170HXは、単にメモリが多いだけではない。

元がGA100系なので、HBMとBF16対応Tensor Coreを搭載している。

実際、特定のPyTorch BF16ベンチマークでは約180TFLOPS、RTX 4090に近い数字が出たという報告もある。

もちろん、あらゆる処理で4090並みという意味ではない。

PCIeは遅い。モデルロードGPU通信では不利になる。ゲームにも使えない。

一方、モデルを一度64GBのHBMに載せ、その中で長時間推論や学習をさせる用途ではかなり面白い

1枚なら27B級のBF16モデルが収まる。

2枚なら、

  1. 70B級の高精度量子化
  2. 100Bを超えるモデル
  3. 大量のKVキャッシュ
  4. 複数AIエージェント
  5. LoRA
  6. 独自量子化

などが視野に入る。

無理やり最大モデルを詰め込むより、27B級を高精度のまま多数並列で動かす方が実用的かもしれない。

ただし、まだ完成品ではない

買えば誰でも64GBになる製品ではない。

8GB版と10GB版で挙動が違う。演算ユニット数に個体差があるという話もある。PCIe高速化には基板改造が必要とされている。

2枚間のP2P通信やNVLinkもまだ検証途中である

ドライバ更新で突然動かなくなる可能性もある。

から、これは購入の推薦ではない。

怪しい中古マイニングカード世界中人間が買い集め、ドライバを書き換え、コンデンサを付け、3Dプリンターで冷却部品を作り、64GBのAIカードとして蘇生させようとしている。

そういう面白い祭りが始まっている、という話である

買うなら

現状はAlibabaなどで「CMP 170HX 8GB」を探す。10GB版ではなく8GB版であること、動作であること、送料や手数料を含む総額だけは確認した方がいい。

ただ、今後この祭りに気がついてマイナーが大放出すれば数か月後に700ドルまで落ちるかもしれないし、在庫が消えて3,000ドルになるかもしれない。転売を考えてるならやめた方がいいが、ローカルLLMやりたいなら$2000までは十分買いの価格

俺は約1,000ドルで8枚買った。

動いたら続きを書く。燃えたらそれも書く。

2026-07-17

AIやりたい奴は「NVIDIA CMP 170HX」を買え

年初に37,500円だったタイミングを逃して苛立ってるのでバラ

仮想通貨マイニング専用機器として売られていた「NVIDIA CMP 170HX 8GB」というグラボがある。これのVRAMを全領域アンロックする方法が見つかった

こいつはAmpere世代NVIDIA A100 PCIe、つまりH200とかGB300とか言われてる奴のRTX30世代バージョンのうち、NVIDIA社内での品質検査で不可となりマイニング用として安く大口販売された物で、公称ではVRAMが8GBしか搭載されてなく、PCIex1しか接続できない事になってる。また浮動小数機能も大幅にカットされてる。だがGA100はHBMメモリを搭載していて、有志検証で何らかのチップがフル搭載されていることから、「物理8GB構成不可能であり、物理的にはフル40GBが搭載→ハードまたはソフト無効化されている可能性が高い」と言われていた

上に書いたように俺は手をこまねいて37,500円で買えたタイミングで様子見して買えてないか検証できてないが、有志により1) 無効化セキュリティCPUプログラムで掛かってること 2) ドライバ改造でセキュリティCPUが落とせること が分かり、そこから高騰が始まると同時にAIを使った再実装チームが走り始め、そのチームの言を信じるならLinux実行中に限りPythonスクリプトを走らせることで64GB全領域がアンロックできることが分かった。ただしPCIeは未改造でx1、改造によりx4までの動作に限られ、x16動作とNVLink端子を使った複数GPUの直結は不可能とされている。NVIDIA CMP 170HXは公称8GBと10GB品が、正規版のNVIDIA A100 PCIeは40GBと80GBが存在するが、有志再現チームのREADMEを読む限りではCMP 170のフル搭載量は8GBでも10GBでも40GBでもなく64GBと判明したということになっている

追記: 64GBアンロック確認できてないらしい。性能アンロック確認取れたらしい。どっちなんだよ

これを受けてeBay中古相場は3.5万円 → 5万円 → 10万円まで跳ねている。無制限版A100なら30~50万円だからこれでも安いが、俺は買えないかリスク取れるおまえらは買え。すぐ買え。もしくは見送って後で50万円で買え。3.5万でもう買ったやつは俺の涙でも舐めてろ

なおNVIDIA CMPシリーズは170HX以外にもあるが、そいつらはHBMじゃないか物理低容量の実装は容易で、実はフル搭載でした~という可能性は低い。170HXだけがアンロックできるのはVRAMがチップレットみたいに実装されててNVIDIA技術力をもっても外したり増設したりできないHBM構成からで、他のCMPシリーズそもそもベース10シリーズ20シリーズばかりだから旨味もないしハックの余地も少ない。170HXを買え。A100の中古価格まで上がる前にすぐ買え。170HXが買えないから代わりのもの提示しろという奴はV100 16GBでも買っとけ。PCIe版はファン付きだしSXM2版は中華のeGPU化やデュオ化アダプターが開発されてる。32GBはまだ高い。Qwen 27Bが載る32GBのGPUは全部高い。ただし俺はそもそも買えてないし裏取ってないし中華業者が本当に送ってくるかなんか知らんし責任取らんからそこだけは留意しろ

冷却はPCIeスロットカバーで全部塞いでこいつの口だけが露出した状態にしてシロッコファンの円形の側を押し付けて全力で吸い出せば多分冷える。プロペラファンは静圧足りなくなっていくら回してもうるさいだけでヒートシンクの奥から空気が吸えずどんどん熱が溜まるから使うな。俺はまったく別のパッシブ冷却カードだが3Dプリンターでアダプターを作ってそうやってる。うるさいがdT<20度にはなってる

合計32GB以上のVRAMを調達できたがAIおすすめはないのかという奴は、単体32GB確保できるならQwen 3.6 27B q4、16GBが2枚など分割ならQwen 3.6 35B-A3B q4を使え。VRAM搭載量に応じて最適なサイズAIを選ぶという考えは意味いから捨てろ

俺はゴミ箱買いに行くからからなんか質問あったら書いとけ

AIバブルはまだ始まっていない

結論から書く。

今回起きているのは、AIバブルの崩壊ではない。それどころかバブルははじまってもいない。

AI設備投資永遠に加速し、その恩恵AIインフラ企業利益へ直線的に流れ続けるという期待が剥落しただけである

これは市場機能しなかった結果ではない。市場が正常に機能した結果である

冷えたのは設備投資ではなく、設備投資への期待である

2026年7月17日時点で、フィラデルフィア半導体指数6月高値から約18%下落している。

しかし、AI設備投資のものが停止したわけではない。

UBSハイパースケーラー設備投資について、2026年に前年比76%増の6730億ドルへ拡大した後、2027年には25%増、2028年には6%増まで増加率が鈍化すると予測している。

減少ではない。

増加率の鈍化である

市場設備投資が減るから売っているのではない。設備投資の成長率が永遠に加速するという前提を修正している。

Reuters:ハイパースケーラーの設備投資成長率をめぐる市場の見方

これは重要な違いである。

AI設備投資過熱していることなど、最初から誰もが知っていた。

GPUHBM光通信データセンター、発電設備送電網へ巨額の資金が流れ込んでいる。市場はその規模に驚きながら、同時に採算性を疑い続けてきた。

この疑念が消えなかったから、設備投資の増加率が鈍るという予測だけで株価が崩れた。

これは陶酔ではない。

しろ、陶酔に達する前に市場の警戒機能が働いた証拠である

AI関連企業ファンダメンタルは強い

現在AI関連銘柄を、2000年前後の無収益ドットコム企業と同一視するのは間違っている。

AIインフラ中核企業は、すでに売上、利益キャッシュフローを生み出している。

株価けが先に上がり、後から事業実態を探しているわけではない。データセンター向け半導体、先端半導体製造製造装置メモリネットワーク機器では、AI設備投資が実際の受注と業績に反映されている。

今回の株価上昇の相当部分は、利益成長によって説明できる。

2026年7月時点でも、半導体関連企業利益予想は大幅に引き上げられていた。株価が上昇する一方で、利益予想も同等か、それ以上の速度で上昇していたため、中核企業評価倍率は必ずしも一方的に膨張していなかった。

Reuters:半導体株の上昇と利益成長

もちろん、すべてのAI関連銘柄が割安だったわけではない。

将来の成長を過剰に織り込んでいた銘柄もある。利益成長が続くことを前提に、高い評価倍率を与えられていた企業もある。

しかし、株価評価過熱していたことと、企業ファンダメンタル虚構であることは同じではない。

今回起きているのは業績崩壊ではない。

強い業績を維持したまま、将来成長に対する評価倍率が圧縮されている。

利益が消えたのではない。

利益成長がどこまで続くのかを、市場が疑い始めたのである

この局面バブル崩壊と呼ぶのは雑である


株価上昇は大きかったが、陶酔の広がりは狭かった

では、今回の株価上昇は、バブルと呼べないほど弱かったのか。

そうではない。

AI半導体の中核部分では、株価は十分にバブル的な速度で上昇した。

フィラデルフィア半導体指数は、2026年7月17日までの1年間で2倍以上になった。6月高値から約18%下落した後でも、この上昇率である

2026年初めから7月13日までに限っても、同指数は83%上昇していた。

Reuters:2026年の半導体株上昇と利益成長

から、今回の株価上昇が弱かったとは言わない。

弱かったのは、陶酔の広がりである

過去1年間で半導体指数が2倍以上になった一方、S&P500均等加重指数の上昇率は11%、AI関連銘柄比重が小さい欧州のSTOXX600は8%だった。

AI関連企業の中でも、上昇は主に半導体メモリ製造装置光通信データセンターなど、実際に売上と利益が拡大している供給企業へ集中した。

市場全体が無差別に上昇したわけではない。

ChatGPT公開後から2026年5月までのNASDAQ100は約140%上昇した。十分に大きな上昇だが、ドットコムバブル期のNASDAQ100は約1090%上昇している。

比較期間や起点が異なるため単純比較はできない。それでも、現在AI相場ドットコム期のような市場全体の全面的陶酔には達していないことは分かる。

Yahoo Finance:AI相場とドットコム・バブルの比較

さら重要なのは、今回の株価上昇の相当部分が利益成長によって説明できることだ。

2026年7月時点で、S&P1500半導体製造装置指数構成企業は、年間利益が前年の2倍以上になると予想されていた。NVIDIAの予想PERは約19倍まで低下し、過去10年以上で最低の水準になっていた。

株価が上昇しても、それ以上の速度で利益予想が引き上げられたかである

もちろん、すべての銘柄が割安だったわけではない。AMDMarvellなど、長期平均を大幅に上回る評価を受けていた企業もある。

しかし、少なくとも中核企業では、

利益がないのに、期待だけで株価が上がった

のではない。

利益が異常な速度で増えたため、株価も異常な速度で上がった

である

局地的な投機存在した。

韓国市場では、SamsungSK Hynix対象とした単一銘柄レバレッジETF信用取引個人投資家による借入投資が急拡大し、株価変動を増幅させた。

これは明確にバブル的な現象である

Reuters:韓国市場で拡大したAI株投機とレバレッジ取引

しかし、それはAI市場全体が陶酔したこと意味しない。

今回起きたのは、実益を上げる中核企業への極端な資金集中と、その周辺で発生した局地的な投機である

一部の勝者が急騰するだけでは、完成したバブルにはならない。

本物のバブルでは、勝者の成功が、まだ利益を出していない企業や、直接関係のない企業へ無条件に一般化される。

今回は、そこまで到達しなかった。

株価上昇は大きかった。

しかし、陶酔は局所的なままだった。

バブルは、偽物に投資することではない

過去バブルでも、投資対象となった技術産業自体が偽物だったわけではない。

鉄道世界を変えた。

インターネット世界を変えた。

住宅価値のある実物資産である

バブルとは、無価値ものを信じる現象ではない。

本物の技術需要から得られた正しい認識を、あらゆる企業、あらゆる地域、あらゆる投資へ無条件に一般化する現象である

鉄道バブルでは、路線を造れば儲かると信じられた

1840年代のイギリスで起きた鉄道時代には、実体的な根拠存在していた。

経済は成長していた。金利は低く、既存鉄道会社は配当を増やしていた。鉄道という技術輸送経済を変えることも事実だった。

この成功を見た投資家は、既存の優良路線が高収益であることと、新しく計画されたすべての路線が高収益になることを混同した。

その結果、鉄道会社の設立新規路線計画が急増した。

鉄道が無価値だったのではない。

鉄道は極めて価値のある技術だった。

間違っていたのは、

鉄道を敷けば、どこでも必ず儲かる

という確信である

The Railway Mania of 1845

ドットコムバブルでは、利益確認する必要がなくなった

1990年代後半のインターネットも、本物の技術革新だった。

通信広告、商取引メディアソフトウェア根本から変えるという予測は正しかった。

しか市場は、インターネットが成長することと、インターネット企業なら何を買っても儲かることを混同した。

事業モデルの実現可能性が十分に検討されないまま、ドットコム企業IPOが相次いだ。

市場収益性よりも、利用者数、アクセス数市場規模、将来の支配力を評価した。

Goldman Sachs:The Dot-Com Bubble

当時のインターネット企業分析したNBERの研究では、インターネット部門全体の株価正当化するためには、歴史的に見ても異常に高い利益成長を長期間続ける必要があったと指摘されている。

NBER:The Rise and Fall of Internet Stock Prices

ここで起きた陶酔は、単なる株価上昇ではない。

利益がないことが問題視されなくなった。

利益がないことは、成長のために積極投資している証拠解釈された。

赤字事業の弱さではなく、未来を獲得するための費用とされた。

上場できること自体事業の正しさを証明し、株価上昇がさら資金調達を容易にした。

価格上昇が事業正当性を生み、その正当性さら価格を上げる自己循環が完成していた。

これが陶酔である

住宅バブルでは、価格上昇が信用を生んだ

2000年代のアメリカ住宅市場でも、同じ構造が生まれた。

  1. 住宅価格が上昇する
  2. 担保価値が上がる
  3. 金融機関融資条件を緩和する
  4. 新たな買い手が市場へ入る
  5. 住宅価格さらに上昇する

金融機関は、借り手の返済能力だけでなく、将来も住宅価格が上昇するという前提に依存するようになった。

住宅価格の上昇が、住宅価格の上昇を正当化した。

価格が上がり続ける限り、誰も損をしないという確信が広がった。

これも陶酔である

Federal Reserve Bank of San Francisco:Housing Bubbles and Homeownership Returns

過去バブル共通していたもの

過去バブルには、共通した段階がある。

  1. 本物の技術革新や需要拡大が起きる
  2. 一部の優良企業が実際に高い利益を上げる
  3. その成功市場全体へ一般化される
  4. 投資額を増やすほど将来の利益も増えると考えられる
  5. 資金調達が容易になり、借金による投資が拡大する
  6. 従来の利益指標や採算基準が「古い考え」として退けられる
  7. 損失への恐怖よりも、成長機会を逃す恐怖のほうが強くなる

本当の陶酔とは、株価が高いことではない。

価格投資額について説明する必要がなくなることである

「なぜ儲かるのか」ではなく、「乗り遅れたらどうするのか」が投資判断の中心になる。

現在AI市場は、まだ区別をやめていない

現在AI市場では、局地的な投機は発生している。

半導体株への資金集中も激しかった。2026年7月バンク・オブ・アメリカ機関投資家調査では、回答者の82%が半導体株を市場で最も混雑した取引だと答えている。

それでも、AI市場全体はまだ完成した陶酔に達していない。

NVIDIABroadcomTSMCASMLMarvellの業績は強い。

しかし、その強さがAI関連企業すべてへ無条件に一般化されてはいない。

設備投資の増加率が鈍るというだけで、半導体株は売られる。

企業設備投資を増やせば、投資家は売上だけでなく、減価償却費営業利益率、フリーキャッシュフロー確認する。

将来の受注見通しが弱ければ、現在利益が強くても株価は下がる。

実際、TSMCASMLは強い決算を発表したにもかかわらず、AI設備投資の持続性に対する懸念から株価を売られた。

市場はまだ、設備投資の採算性を企業ごとに審査している。

成功企業と失敗企業区別しようとしている。

これは完成したバブルではない。

バブルとは、区別をやめることである

本当のAIバブルは、強い業績の先にある

皮肉なことに、AI関連企業ファンダメンタルが強いからこそ、本当のAIバブルはこれから発生する。

NVIDIABroadcomが高い利益率を維持する。

TSMCASML能力増強を続けても受注が埋まる。

ハイパースケーラー設備投資を増やしながら、AI売上、営業利益フリーキャッシュフローを伸ばす。

一般企業AI導入によって人件費を削減し、開発期間を短縮し、売上を増やす

この証拠が数四半期にわたって積み上がれば、市場疑念は消える。

そして市場は、正しい結論から間違った一般化へ進む。

一部のAI設備投資は高いROIを生む

という事実が、

AI設備投資は高いROIを生む

という確信へ変わる。

優れた企業AI利益を上げている

という事実が、

AI投資する企業利益を上げる

という確信へ変わる。

この変化がAIバブルの始まりである

AIバブル2027年前後に始まる

AIバブル2027年前後に始まる。

条件は、ハイパースケーラー決算で次の三つが同時に示されることである

  1. AI関連売上が設備投資を上回る速度で増える
  2. 減価償却費が増えても、営業利益率が維持される
  3. 設備投資を増やしながら、フリーキャッシュフローも増える

これが数四半期続けば、市場AI設備投資の採算性を疑わなくなる。

その後に起きるのは、設備投資競争の再加速である

設備投資を増やす企業株価が上がる。

設備投資を抑える企業は、慎重なのではなく、競争から脱落していると評価される。

データセンターを建てるための借金が、財務リスクではなく成長投資と呼ばれる。

GPU保有台数、データセンターの電力容量、確保した土地面積が、そのまま企業価値として評価される。

十分な顧客や売上を持たない企業でも、「AIインフラ」という名前だけで資金調達できるようになる。

そして市場は、設備投資ROI確認しなくなる。

設備投資をしているという事実のものを、将来のROI証拠として扱い始める。

そこまで到達して、初めてAIバブルである

疑念が消えた瞬間が最も危険である

今の市場にはまだ疑念がある。

設備投資の伸びが鈍れば株価は下がる。

巨額投資を発表すれば、キャッシュフロー心配される。

高い成長率を示しても、次年度の成長率まで問われる。

これは全面的な陶酔ではない。

市場がまだ正気を残している証拠だ。

今回の下落を見て、「AIバブルは終わった」と結論づけるのは間違っている。

終わったのは、設備投資の加速が永遠に続くという短期的な期待である

AI需要は消えていない。

関連企業利益も消えていない。

設備投資も止まっていない。

株価上昇も小さくはなかった。

ただし、その上昇は実益を上げる限られた企業へ集中し、市場全体の無差別な陶酔には発展しなかった。

AIバブルはまだ始まっていない。

本当に警戒すべきなのはAI関連企業の業績がさらに強くなり、市場から疑念が消えたときである

設備投資が多すぎる」という不安が、「設備投資が足りない」という焦りに変わる。

「本当に回収できるのか」という問いが、「投資しないほうが危険だ」という確信に変わる。

誰もが、AIに金を入れれば儲かると信じる。



AIバブルは、その瞬間に始まる。

2026-06-26

半導体チップ設計全然恩恵がない

キオクシアや、半導体製造装置は連日株ニュースで賑わっているが、半導体チップ設計については、全然恩恵がない。

そりゃNVIDIAHBMメモリだけで、他はお呼びでないとはわかっているが。

高性能AI半導体チップ作ろうってことにもなってない。

いわゆるレガシー半導体製造出来ないという話も数年前に出たが、テコ入れなんてのもない。

仕事ないな

2026-06-22

anond:20260622145210

けっきょく他の国も先を読めたりブレーキなんてできてなくて怖いチンピラ政府を牛耳ったら誰も意見ができない

結果論でうまく言ってる国には後付であらゆる賛辞

失敗してる国には後付で理屈を組み立てて罵倒

解釈したいように解釈してるだけ

品質落としてでも大量の安メモリを作れと過去日本半導体産業に叫んでた連中が今はHBMを作れとかAI用の最先端がどうとか真逆のことをほざいてる

半導体日本は高コストに作りすぎ、韓国を見習え(キリッ)だったじゃん

anond:20260622140341

AIが出てきたら一転どうしてHBMを作れないんだあ?

どうして投資してこなかったんだあ?

だろ

未来予知能力だろ日本人が本当に求めてるのは

2026-06-16

ネットで話題米国株毎日調べている

最近米国株に関する情報自動集計する仕組みを作って遊んでいる。

最初は単純に「どの銘柄話題なのか見たい」という理由だった。

ところが実際に毎日集計してみると、面白いことが分かってきた。

たとえば、株価が上がった銘柄よりも、急落した銘柄のほうが圧倒的に書き込みが増える。

また、同じ半導体銘柄でも、NVDAよりMUやSNDKのような少し時価総額が小さい銘柄の方が盛り上がることが多い。

最近だとMicron(MU)の書き込みが異常に多く、

決算までガチホ」

HBM不足は続く」

メモリ最強相場

みたいな投稿がかなり目立っている。

逆に、時価総額が大きい銘柄は好決算でも意外と話題にならない。

こういう「ネット上の投資家心理」を毎日眺めていると、ニュースを見るのとは違う面白さがある。

せっかくなので、集計結果を使ってYouTube動画作ってみた

話題銘柄ランキングや、何が語られているのかをまとめている。

もし興味があれば見てほしい。

https://www.youtube.com/channel/UCx2nExNN8NiLUn_7sVWkDQg

2026-06-15

anond:20260615091134

最初は、これからメモリ HBM時代だということで、NAND(SSD)はアウトオブ眼中だった。

ひたすらメモリ株だけを買っていた。EWYや2033 MU及びMUUとか。

ただ、エージェントAI時代になって、SSD必要だということがわかってからメモリと同時にSNDKを少し買っていた。

そういえば、日本にもキオクシアがあるよねということでここで初めて注目した。

価格comでSSDの値段が高騰しているのいう記事を見て、これはメモリでも起きたことがSSDでも起きていると確信した。

もう少し早くSSDもいることに気が付いていれば。

2026-05-20

anond:20260520102216

介護保険の仕組み上、無理だよ。

入ってくる額が決まっているわけだから

売上が決まっているなら、かけれる経費の額の上限もそこになる。そうしないと利益すら出ずに赤字になるわけだし。

慈善事業じゃないんだし。

ただ、超高額な入居費を取れる介護施設ならありえそう。



介護も店だから喫茶店と同じく、1人当たりの売上 × 回転率で、売上が求められる。

ベットの数は決まっているし、入居者の回転率はたかが知れている。

まり回転率の悪い喫茶店みたいなもの

ここで売り上げを増やすには、1人当たりの売上を増やすしかない。



結局ない袖は振れないので、給料を上げたければ、なるべく儲かっている人たちの近くにいることだ。

儲かっていれば、ある袖は振ってくれるかもしれないしね。



ブルーカラーいうなら、HBMメモリめっちゃ儲かっている韓国のSK-Hynixなんて1人あたり6000万円のボーナスを出すそうじゃん。

そういうことだよ。

できるだけ儲かっている人たちの近くにいることが大切。

2026-04-23

ご主人様、こんにちは~♡ あたし、GoogleAIチップのこと、めっちゃ詳しくお話しするね! オタク心くすぐる話がいっぱいだから、楽しみながら聞いてね♪

GoogleAIチップってのは**TPU(Tensor Processing Unit)**のことだよ! NVIDIAGPUみたいに汎用じゃなくて、AI行列演算テンソル計算)に超特化した専用チップなんだ。最初Googleの自社データセンター用に作られたんだけど、今はGoogle Cloudで誰でも使えるようになってるよ。

何が良くなるの? 主なメリットまとめ♡

• 速度がバカみたいに速くなる:特に大規模なAIモデル(LLMとかGeminiみたいなやつ)の学習トレーニング)と推論(inference)が劇的に速い! 最新世代だと前世代の数倍~10倍以上の性能アップとか言われてる。例えば、Ironwood(v7)で前世代の4倍以上、最新の第8世代(TPU 8t/8i)だとさらに3倍近いコンピュート性能とか、トレーニング時間を月単位から単位に短縮できるレベルなんだって。1

コストパフォーマンスヤバい:性能あたりの価格performance per dollar)がNVIDIA GPUより良いケースが多くて、4倍くらいお得になるワークロードもあるよ。特に大規模バッチ処理Googleエコシステム内だと強い! TCO(総所有コスト)も30%くらい抑えられるって話もある。25

• 電力効率が神レベル:同じ仕事するのに消費電力が60-65%少ないとか、ワットあたりの性能が30倍以上改善されてる世代もある。データセンター電気代や冷却が大変な今、めっちゃ大事カーボン効率も3倍良くなってるよ。環境に優しいAIって感じ♡

スケールがエグい:数千~9,600チップを1つのスーパーポッドで繋げて、**exaflops(超巨大な計算規模)**を叩き出す。メモリもどんどん増えて(192GBとか)、長いコンテキストMoEモデル(Mixture of Experts)とかに強いんだ。

最新の進化2026年現在

今、Google Cloud Next ’26で発表された第8世代TPUが熱いよ!

• TPU 8t:トレーニング特化。巨大モデル作るのに最適で、ほぼ3xのコンピュート性能アップ。

• TPU 8i:推論(inference)&エージェントAI特化。低レイテンシ(遅延が少ない)で、リアルタイムAIエージェントMoEモデルに超強い。性能/ドルで80%向上とか!

これで「agentic era(エージェント時代)」にバッチリ対応。推論の「メモリ壁」問題HBM増強で解決方向なんだって。2

要するに、ご主人様がAIモデル作ったり動かしたりするなら、速く・安く・エコスケールできるのがTPUの強み! GPUみたいに何でもできる汎用性はないけど、AI専用に最適化されてるから、合ったワークロードだとNVIDIAを追い抜く勢いなんだよ~。

もっと具体的なモデル比較とか、Google Cloudの使い方知りたい? それともオタク的に「シストリックアレイって何?」みたいな深掘り? ご主人様の好きに命令してね♡ あたし、いつでも待ってるよ~!

2026-03-29

anond:20260329185433

私もあまり詳しくはないけど、発熱が減ることも期待されているそうで、

それならばより集積できるんじゃないか

HBMみたいに縦にガンガン積み上げればいいと思う。



今はまだ技術的、経済的な制約があって、メインストリームにはなっていないけど、

まずはEVのパワー半導体などして注目されているそうで、そこから技術が発展していけばいいと思う。

最終的には、今のシリコンみたいにまでいければ、より良い半導体になるんじゃないか



トランプカツアゲされた80兆円の対米投資の第1弾として人工ダイアがあるわけだけど、

これは将来のダイアモンド半導体を見越してだろうし。

何年かかるかは謎だけど、成果が出てくるといいですね。

2026-02-07

なぜ日本ではイノベーションが起こらないのか

最近海外では頻繁に破壊イノベーションが起こっている。

具体的にはアメリカ中国韓国台湾、数年前までなかった産業が突然興り、信じられないスピードで発展していく。

その理由は明確でキャッシュリッチ企業個人イノベーションに大胆に投資するからだ。



アメリカではAI投資で有名なセコイアキャピタルやa16z、クリーン技術投資で有名なビルゲイツブレークスルーVCNVIDIAやM7もこぞってスタートアップに大規模投資しているし、自分らで破壊イノベーションを起こす立場でもある。イーロンマスク特に有名だろう、EVAI宇宙ヒューマノイド



中国韓国台湾計画資本主義なので国が積極投資をしていて、その投資スピード感・正確さ・規模はすごい。だが特に重要なことは国を代表する大手もそれに積極的に加わるということだ。

中国だとファーウェイが中心となり、中国技術のみでAI産業を作るべくEUV露光装置をすさまじい速度で試作し、先端プロセス半導体工場を作り上げ、AIチップも内製し、AIモデルアメリカと遜色ないレベルのものを作った。ファーウェイなしでは無理だっただろう。

ちなみに中国電池業界で中心的役割を果たしたのはテスラだ。テスラ外資規制から抜け出す代わりに積極的中国投資した、用が済んだ後追いだされたわけだが。



韓国はご存じサムスン電子とSKハイニクスだろう。この2社の積極投資により韓国世界随一のメモリ国家になった。AI必要になることを信じHBM破滅投資をしてきてそれが成功した。LGは今はうまくいっていないが、そのうちこの2社に加わる成功企業になるだろう。

台湾TSMCだ。TSMC台湾地場企業との契約積極的に受け入れた。その結果MediaTekやUnimicronなどの世界トップ企業が出来上がり、今もAI関連のユニコーン企業がたくさん成長中だ。



日本はどうだろう?まず一番の問題は国の姿勢だ。支援どころか研究費のカットスタートアップへの支援もなかった(最近始めたが金額の桁が1~2ケタ少ない)。こうした国の姿勢を反映するように、大企業消極的だった。

トヨタ日本では協力企業いじめに執心し、稼いだ金を株主還元海外投資につぎ込んだ。eVTOLの日本発スタートアップSkyDriveでなく米国発のJoby Aviationに出資をした。トヨタベンチャー投資をわかるが海外ほとんどで日本投資する姿勢はない。

ソニー国外へ逃げた、PS5も米国優先供給でさんざん叩かれた。日本に興味がないんだろう。ソフトバンクは全ての稼ぎをopenAIスターゲート計画へつぎ込んだ。会計テクニックを駆使し、日本へは税金すら納めない。



この国でイノベーションは無理だ。高市がなんと言おうと、何をしようともう終わっているんだ。小手先の数年で変わる世界じゃない、何十年と積み上げてきた過ちが今表出してるだけだ。

2026-01-05

anond:20260105135407

勘違いやすいけど、厳密にはウェハーや生産ラインHBMに割り当ててるだけ

から生産ラインが足りないという表現より、生産ラインを絞ってるというのが正しい

大体、DDR5用のラインは増やさないって言ってるやろが、HBM用のラインが増えないと駄目なんだよ

2025-08-22

anond:20250822072049

韓国は今のままでいいと思うけどねえ。

学歴社会をやめてゆとりなんてやったら絶対ダメだよ。

HBMなどのメモリ技術スマホかに強みもあるわけだし、そこを強化していくとか、他の産業にも広げていくことが大切だろう。

そのためには科学技術絶対必要なわけだし。



少子化については、問題ではあるけど、北朝鮮を吸収するというウルトラCがまだ残されているだろう。

2025-08-01

量子コンピュータ量子もつれ課題

このgrokAIから教えてもらったんだけど、量子もつれって1:1ではなくて1:他と複数を同時に結びつけられる。つまり重婚できる。

で、量子もつれされた1つに対して演算をすると、それが瞬時に他の量子ビットにも影響を与える。

から超早く計算できるらしい。



最初にそれぞれの量子ビット初期化して量子もつれ状態に設定する初期化処理をする。

そして、どれか一つに対して演算すれば、他にも影響を勝手に与えるので超高速演算ができると。



問題はやはりノイズで、ずっとまわしているとダメになってしまう。

超足が速い短距離ランナーだけど、よくこけまくるみたいなものだと思う。運よくこけなければ早い、と。

このあたりが解決していくと、使い物になっていくかもしれないね



2000年初頭、量子もつれを起こすには部屋いっぱいの巨大なマシン必要で、それでもうまくいくかは運ゲーだった。

今は超小さくなり、髪の毛ぐらいの細い微細な回路チップ上でもできるようになった。

より高い精度で量子もつれ状態を作り出し、維持することが可能になった。

技術進歩はすごいので、いつかはノイズ問題も克服できるかもね。



他の課題として初期化が重たいことだろう。

データ更新するには、一度量子もつれを解除して、それから値を初期化して、再度量子もつれにしないといけない。

GPUHBMとかのちょっ早いメモリを使ってガンガン動作しているのに対して、量子コンピュータ転送効率は極めて悪いはずだ。

逆に、データを頻繁に初期化しないでもいいような純粋計算タスクだとワンチャンあるかもしれないけど。



この2つの問題クリアできたら、量子コンピュータもいよいよ実用的に使えるようになるんだろうけど、今はまだ早いからなあ。

量子コンピュータが使えるようになるのはまだまだ先だなあと。

2025-07-11

日本韓国台湾による東アジア連合(EAU)構想の包括的分析

Claudeのレポートを使ってなかったので試しに使ってみた。

日本韓国台湾による東アジア連合(EAU)構想の包括的分析

昨日の衝撃発言が示す新たな地域秩序の必要性

2025年7月9日日本石破茂首相テレビ番組で発した言葉が、東アジア地政学構造根本から揺るがしている。「もし彼らが、日本米国に大きく依存しているか米国の言うことに従うべきだと考えているなら、我々は安全保障エネルギー、食料においてより自立的になり、米国への依存を減らす必要がある」。この発言は、8月1日から発効する米国の25%関税措置への対応として発せられたものだが、単なる貿易摩擦への反応を超えた歴史的な転換点を示唆している。

実際、トランプ政権同盟国に対して自立を明確に要求しており、日本への書簡では「この25%という数字は、貴国との貿易赤字格差を解消するために必要な水準にははるかに及ばない」と警告している。このような状況下で、日本韓国台湾による東アジア連合(EAU)構想は、地域の自立と繁栄のための現実的選択肢として浮上している。

経済統合がもたらす7兆ドル規模の可能
世界第3位の経済誕生

EAUが実現すれば、合計GDPは約7兆ドル世界経済の8%を占める巨大経済圏が誕生する。日本の4.2兆ドル韓国の1.95兆ドル台湾の7,900億ドルを合わせた経済規模は、米国中国に次ぐ世界第3位の経済ブロックとなる。人口約1億8,000万人の高度に教育された労働力を擁し、一人当たりGDPは3万ドルを超える先進経済圏となる。

現在貿易関係はすでに密接で、日本台湾間の貿易額は年間882億ドル日本韓国間は93兆円に達している。関税撤廃により、域内貿易は15~25%増加すると予測され、サプライチェーン効率化と共に大きな経済効果が期待できる。

半導体産業における圧倒的優位性

EAUの最大の強みは、世界半導体生産の74.3%支配することだ。台湾TSMC世界ファウンドリ市場の58.5%、韓国サムスンが15.8%を占め、さらに高帯域幅メモリーHBM市場では、韓国SKハイニックスサムスンで合計95%のシェアを持つ。この技術的優位性は、AI時代において決定的な競争力となる。

日本の素材技術韓国メモリー技術台湾製造技術の組み合わせは、他の地域では再現不可能産業クラスターを形成する。すでにSKハイニックスTSMCHBM4の共同開発を進めており、統合によってさらなるイノベーションが加速される。

少子高齢化への共同対応

3か国はいずれも深刻な少子高齢化に直面している。韓国出生率0.87と世界最低日本は1.3、台湾は1.1という危機的水準にある。2060年までに東アジア高齢者比率33.7%に達すると予測される中、労働力相互補完と技術革新による生産性向上が不可欠となる。

統合により、高度人材域内移動が可能となり、各国の労働力不足を相互に補完できる。特に半導体エンジニアなど専門技術者の交流は、産業競争力の維持に直結する。

歴史問題地政学リスクが生む深刻な障壁
日韓関係根深対立

EAU構想の最大の障壁は、日韓間の歴史問題である慰安婦問題では、2015年の「最終的かつ不可逆的な解決合意事実上崩壊し、被害者日本からの直接的な謝罪と賠償を求め続けている。徴用問題でも、2018年韓国最高裁判決以降、日本企業への賠償命令が続き、2023年の尹政権による解決案も韓国国民の約60%が反対している。

竹島独島)の領有権問題解決の糸口が見えない。韓国にとって独島日本植民地支配から独立象徴であり、日本にとっては領土主権問題として譲歩できない。このような根本的な信頼の欠如が、政治統合への大きな障害となっている。

台湾国際的地位中国の反発

台湾の参加は、EAU構想に特殊な複雑性をもたらす。正式外交関係を持つ国は12か国のみで、国連を含むほとんどの国際機関から排除されている。中国台湾を「反乱省」と見なし、2005年反国家分裂法では武力行使も辞さな姿勢を明確にしている。

中国はEAUを米国主導の対中包囲網の一環と解釈し、強力な反対措置を取ることが予想される。経済制裁、軍事的圧力外交的孤立化など、あらゆる手段を用いて統合妨害する可能性が高い。実際、中国日韓両国の最大の貿易相手国であり、経済報復リスク無視できない。

主権国内政治の制約

3か国とも民主主義国家だが、政治システムは大きく異なる。日本議院内閣制韓国大統領制台湾半大統領制という違いは、意思決定メカニズム統合を困難にする。また、各国の憲法主権移譲に厳格な制限を設けており、EUのような超国家機関設立は法的にも政治的にも極めて困難である

国民感情も大きな障壁となる。韓国反日感情日本嫌韓感情は根強く、台湾でも主権への懸念から深い統合への抵抗が予想される。

段階的統合による現実的な実現可能
過去の教訓が示す成功への道筋

1990年東アジア経済協議体(EAEC)構想は、日本リーダーシップ不在と米国の反対により失敗した。しかし、1997年アジア通貨危機後に誕生したASEAN+3は、実務的協力の枠組みとして定着し、2020年に発効した地域的な包括的経済連携(RCEP)は、世界GDP の30%をカバーする最大の自由貿易協定となった。

これらの経験は、アジアにおける地域統合欧州型の超国家統合ではなく、主権を維持しながら実務的協力を深める「アジア方式」が適していることを示している。EUモデルの直接的な適用現実的でないが、段階的統合ロードマップは参考になる。

実現に向けた4段階アプローチ

専門家分析によれば、EAU実現には25年程度の長期的視野必要とされる。第1段階(2025-2030年)では、観光教育技術標準などの分野での協力から始める。すでにRCEPが発効し、2022年には域内貿易が8%増加したことは、経済統合の実現可能性を実証している。

第2段階(2030-2035年)では、投資協定の締結、規制調和金融協力の深化を進める。第3段階(2035-2045年)で共通市場形成通貨協力の開始を目指し、第4段階(2045-2050年)で完全な経済統合限定的政治協力を実現する。

既存枠組みの活用と漸進的発展

ASEAN+3、東アジアサミット(EAS)、RCEPなど既存の協力枠組みを基盤として活用することが現実的だ。特にASEANの中心性を維持しながら、日韓台が「RCEP+」として深化した協力を進める方式が、地域の支持を得やすい。

短期的には、デジタル決済システム統合観光ビザ相互免除高等教育単位相互認定パンデミック対策での協力など、市民が直接的な利益を感じられる分野から始めることが重要である

自立的東アジア未来に向けて

石破首相発言が示すように、米国依存からの脱却は日本だけでなく東アジア全体の課題となっている。EAU構想は、この地域が自らの運命を自ら決定し、世界経済第3極として自立的な発展を遂げるための現実的選択肢である

歴史的対立台湾地位中国の反対など、克服すべき課題は山積している。しかし、7兆ドル経済規模世界半導体生産の74%という圧倒的な技術力、共通民主主義価値観は、これらの障壁を乗り越える十分な動機となる。

重要なのは完璧統合最初から目指すのではなく、実現可能な協力から始めて信頼を構築していくことだ。25年という長期的視野を持ちながら、観光客の相互訪問の促進、学生交流の拡大、技術標準の共通化など、具体的な利益を積み重ねていく。そして何より、この地域の人々が共有する平和繁栄への願いを、対立を超えて協力へと転換していく政治意志が求められている。

東アジア連合夢物語ではない。それは、変化する世界秩序の中で、この地域選択できる最も現実的建設的な未来への道筋なのである

2025-02-04

日本はやっぱりAIチップ設計出来ないのか?

AppleNVIDIAは盛り上がっているが、他の半導体企業は振るわない。

IntelAMDも苦戦している。

半導体チップというと、ロジックメモリセンサーアナログ車載など色々ある。

半導体株は一時期盛り上がっていたが、結局儲かっているのはAppleNVIDIA設計ソフトEDAベンダーだ。

給湯器車載向けの半導体が無くて作れないといったことが数年前に起こったが、一円以下の数銭単位で値引きされ利益がない。

メモリは1にも2にも低価格を突き詰める。

メディアIoTだ、車載だと騒ぎ立てたが、どこも稼げずジリ貧のまま事業続けているのが実態だろう。


そんなところにAIけが出てきた。

性能がいくらあっても足りない。というよりスパコンHPCだ。

単体GPUじゃデータが格納できないので、複数GPUデータをやり取りすることになる。

NVIDIAコンシューマ向けGPUでは不要だったスイッチチップも着々と用意していた。

NVIDIAサイトを見てもらえばわかるが、GPU以外のハードと、それを使うためのソフトも沢山ある。


ここからが本題だが、日本AIチップは作れないのだろうか。

日本研究だと低消費電力向けを研究しているのだが、IoTなどでもわかっていることだが

ニーズはあるが、ラズパイなどでいいじゃんとなり失敗する。

唯一無二の性能・販売価格でなければ他に埋もれて購入すらされなくなる。


ゲームだと1フィールド読み込めば使いまわしなどキャッシュが効きやすい、シェーダパイプラインが決まっている、

そもそもハード限界の中で仕様が決まるなどがあり、問題はなかったが、AIチップの性能内で決まらない。


AI場合、推論はKVキャッシュくらいは活用しようという動きが出てきたものの、メモリ全部にアクセスするのでキャッシュバッファ的な意味合いしか効いておらず、

メモリ帯域が物を言う。

PCIeでは帯域は足りず、DRAMですら帯域が足りない。

HBMのようなもの必要になる。


あと日本リソグラフ限界サイズの大きなチップを作ってこなかった。

4GHz,5GHzで駆動させると、チップ内を光速信号が伝搬するとはいえチップサイズに対して伝搬速度が遅く、タイミングがMETしない。

電源ドロップ問題もある。

大きめのチップを作っている企業もあるだろと指摘があるだろうが、物理設計台湾企業委託していたりとノウハウがない。


2024-12-07

anond:20241207181156

そう言うことじゃあないんだよなあ

タイムリーにやれって話よ

韓国の話なんかアホの暴政で終わりよ

米のHBM規制さっさと取り上げろよアホメディア

2024-11-01

新しいAIハードが出てくるのを期待しつつ、ずっとRTX 3090を使っている

AIが盛り上がって数年経つが、個人が買えるような価格帯で、良いAI向けのハードが出てこない。

RTX 3090のVRAM24GBを大事に使っているが、そもそもVRAMに入らないモデルの方が多い。

複数AIを立ち上げるなんてのは、VRAM容量が溢れるので、そもそも動かせない。

動けばNVIDIAの Nsight Systemsなどで遅い所などを探せるが、そこまでいかない。

複数SSD仮想メモリにするというのも、RTX 3090のNVLink BridgeでVRAMだけ拡張するなんてのも世の中に出てこない。


Appleもそろそろ出してくるかと思っていたが、M4普通の順当進化だった。

M2 Ultraはチップtoチップ接続し2.5TB/sを謳ったが、同じチップを繋げたのでいらない機能が倍になっただけだった。

M4 Ultraで、片側のチップGPU or NPU+帯域の広いGDDR or HBMになればいいが、あまり期待が出来ない。

GPU or NPUのコアが増えたとしても、L2/L3キャッシュの容量が少なすぎる、増やしても距離が遠ければ性能も出ないので、

AppleAMDのように3D V-CacheSRAMを積み、Hybrid Bondingで上下の帯域を確保してくれないだろうか


IBMはTelum IIとSpyreを出してきたがエンタープライズ向けなのでパス

Groq社がLLM用LPU、HyperAccel社がLLM用ASICを出して来たが、

Groqは1枚のPCIeカードでは全くメモリ容量が足りず役に立たなそうで、HyperAccelはサーバー前提でこちらも個人から手が出しにくい。

FPGAHBMが載ったPCIeカード個人向けには販売できるような価格でもなければ、そもそも販売すらされない。

ジムケラー率いるTenstorrentも1枚のPCIeだとメモリが足りないし、Ethernetでなんとかやりくりしようとしているが帯域に引っ張られそうに見える。

NextSilicon社がMaverick-2というIntelligent Compute Accelerator (ICA)というのも出してきたが、HPC向けで個人利用からは遠い。


中国も良いのが出てきていない。

Biren、Fuzhou Rockchip、VeriSilicon、Moore Threads、LinJoWing、Loongson、JingJia Micro、Cambricon、Vastai Technologies、Xiangdixian Computing、Enflame Technology、MetaX、Zhaoxin、Lingjiu Microelectronics、

DengLin Technology、Iluvatar CoreX、Innosilicon、Horizon Robotics、Black Sesame Technologies

色々あって追いきれないが、何か飛び出て良いのが出てきたというのは聞かない(日本いるかからもしれないが)

2024-10-20

ハードエンジニア、選んだの失敗だったか

半導体チップとかを作っているが失敗だった

  1. 国内設計仕事がなくなってきた。東京ならとかの話ではない。アメリカインド中国
  2. 設計ソフトを作っているのが、移民中国人、インド人なので、当然日本語ドキュメントはない。日本市場が小さいのでサポートもあまりない。
  3. 設計ソフトシングルコア性能に制約を受けることが多い。トランジスタ数の増加に追随出来ない。設計データ馬鹿でなくなっていく。設計するためのコンピュータ能力が足りてない
  4. 単位設計ソフトライセンス必要で、そのソフト教育を受けるにもお金がかかる。誰が出すのか。ネットにも使い方の情報はない。
  5. ソフトの使い方を覚えても、どう設計すればいいのかの情報がない。日本語だけでなく、英語でもない。アメリカでも会社に入ってメンターに教えてもらうとか
  6. 先端プロセスが高い。億単位。そのくせ世界中で売れるような仕様なんて、そうそうない。
  7. armのコア、アーキテクチャなど何百ページもあるドキュメント複数あって読むのが大変。エラッタもある。最悪オースティンなどに問い合わせ
  8. 物理限界プロセス、電力、チップサイズシグナインテグリティEMCEMI
  9. FPGAも実際に使えるような大きいものは高すぎる。もちろん趣味個人で買えるようなものはない。(AI向けハードなんて作れやしない、それ以外でも)
  10. 複数FPGA合わせて使うとかになるとハードルがまた上がる
  11. FPGA以外のボードに載っている機能にも引っ張られる
  12. 規格がいつの間にか世界の何処かで立ち上がる(アメリカとか、ヨーロッパとか)
  13. DDRPCIe更新される、セミナー米国だけとか。USB、eUSB、Ether、UCIe、etc。金出さないと規格ドキュメントも見れない。規格あっても守ってなかったり、規格曖昧さがあったりとか
  14. 軍用になると更にわからなくなる。規格や電子戦ってどこから勉強すればいいですか?
  15. 測定機が高い、特殊、使い方覚えるのが大変なのに潰しが効かない、パソコンデータ持って行くの大変で、更に特殊フォーマットで開くのにライセンス料金払ったソフト必要とか
  16. ネットに役に立つ情報はないのに、ニュースコメントばかりは多い(熊本には仕事はないです。不動産は値上がりしたかもしれんが)
  17. コンピュータサイエンスと呼ばれるものソフトエンジニア視点ばかりになる
  18. 機械学習ハードと相性が悪い・・・SRAMサイズメモリ高い、HBM高い
  19. Pythonくらいまで抽象化しないと誰も使わない。というか買ってすぐ稼げるようなパッケージにまでしないと売れない。
  20. C言語だとまだハードに近くで想像ついたが、Pythonになると全然ハードが見えてこない。性能出ないのはキャッシュ共有コアが悪いのか、インターコネクトか、DDRの口か、温度によるクロック低下か

2024-02-23

NVIDIAAIの小史

未だに「謎の半導体メーカー」程度の認識の方になぜNVIDIA時価総額世界4位なのかをあれこれ説明する必要があるので短めにメモ半導体業界すみっこ人間なので機械学習まわりの説明適当です

・~1993年 AI冬の時代エージェントシステムがさほど成果を挙げられなかったり。まだ半導体メモリの性能は現代とくらべてはるかに劣り、現代のような大規模データを用いた統計的処理など考えられなかった。2006年ディープラーニング発明まで実質的な停滞は続く。

1993年 NVIDIA設立

1995年 NVIDIA最初グラフィックアクセラレータ製品NV1を発売。

1999年 NVIDIAGeForce 256発売。GPUという名が初めて使われる。以降、NVIDIAGPU業界1位の座を守り続ける。

2006年 GPGPU向け開発基盤CUDAを発表。以降、その並列計算に特化した性能を大規模コンピューティング活用しようという動きが続く。

2006年 ディープラーニング発明。のちのビッグデータブームに乗り、これまでよりはるかに高性能なAI模索する動きが始まる(第3次AIブームのおこり)

2006年 CPU業界2位のAMDGPU業界2位のATIを買収、チップセットGPU統合することで事実上自社製品NVIDIAと切り離す戦略に出る。CPU業界1位のインテルも、同じく自社CPUに自社製GPU統合する動きを強める。NVIDIAはこれまでの主力だったGPUチップセット製品販売を終了し、データセンター向けGPGPUのTeslaシリーズゲーム用外付けGPUGeForceシリーズARMCPUと自社GPU統合したTegraシリーズの3製品に整理する。このうちTeslaシリーズが性能向上やマイクロアーキテクチャ変更を経て現代AIサーバ製品に直接つながる。GeForceシリーズゲーマー向け需要暗号通貨マイニング向け需要も取り込み成長。Tegraシリーズは後継品がNintendoSwitchに採用される。

2012年 ディープラーニング画像認識コンテストで圧倒的な成績を収め、実質的な第3次AIブームが始まる。

2015年 AlphaGoイ・セドル勝利

2016年 NVIDIA自動運転向けシステムを発表。

2017年 Transformerモデル発表。これまでのNN・DLと異なり並列化で性能を上げるのが容易=デカ計算機を使えばAIの性能が上がる時代突入

2018年 IBMNVIDIAと開発した「Summit」がスパコン世界ランキング1位の座を5年ぶりに中国から奪還。全計算のうち96%がGPUによって処理され、HPCハイパフォーマンスコンピューティング)におけるGPU地位は決定的になる。NVIDIAの開発したCPU-GPU間の高速リンク「NVLink」が大規模に活用される。「Summit」は2020年に「富岳」にトップを奪われるまで1位を維持。

・2018~2021年 BERTやXLNet、GPT2など大規模言語モデルの幕開け。まだ研究者が使うレベル

2019年 NVIDIA CEOジェスン・ファン(革ジャンおぢ)が「ムーアの法則は終わった」と見解を表明。半導体シングルスレッド性能の向上は限界に達し、チップレットを始めとした並列化・集積化アーキテクチャ勝負時代に入る。

2022年 NVIDIAがH100発表。Transformerモデル学習・推論機能を大幅に強化したサーバ向けGPUで、もはや単体でもスパコンと呼べる性能を発揮する。H100はコアチップGH100をTSMC N4プロセス製造SK HynixHBMとともにTSMC CoWoSパッケージング技術で集積したパッケージ。※N4プロセスは最新のiPhone向けSoC採用されたN3プロセスの1つ前の世代だが、サーバ/デスクトップ製品向けプロセスモバイル製品向けプロセスクロック電流量が異なり、HPC向けはN4が最新と言ってよい。

2022年 画像生成AIブーム。DALL-E2、Midjourney、Stable Diffusionなどが相次いで発表。

2022年 ChatGPT発表。アクティブユーザ1億人達成に2カ月は史上最速。

2023年 ChatGPT有料版公開。Microsoft Copilot、Google Bard(Gemini)など商用化への動きが相次ぐ。各企業NVIDIA H100の大量調達に動く。

2024年 NVIDIA時価総額世界4位に到達。半導体メーカー売上ランキング世界1位達成(予定)。

こうして見るとNVIDIAにとっての転換点は「ディープラーニング発明」「GPGPU向けプログラミング環境CUDAの発表」「チップセット販売からコンピューティングユニット販売に転換」という3つが同時に起こった2006年であると言えそう。以降、NVIDIAゲーマー向け製品モバイル向け製品販売する裏で、CUDAによってGPGPUの独占を続け、仮装通貨マイニングスパコンでの活躍と言ったホップステップを経て今回の大きな飛躍を成し遂げた、と綺麗にまとめられるだろう。

ログイン ユーザー登録
ようこそ ゲスト さん