- 1 : 2026/08/10(月) 11:35:59.23 ID:1JFJk8Jbd
AIの基盤モデルの高性能化を巡り、世界中で競争が激化している。Noetra(ノエトラ)に代表されるように、日本でも国産モデル開発の機運が高まってきた。ただし、研究開発でも巨額の投資でも大幅に先行する米国や中国に、日本が伍していくのは容易ではない。そこで重要になるのが、より少ない計算資源で、より高い性能を見込める独自の技術である。
その候補の一つになりうる新たなアーキテクチャを富士通が開発した。既存のLLM(大規模言語モデル)ベースの基盤モデルが利用するTransformerのメモリの利用効率を大幅に高める「PHOTON」と呼ぶ技術である。同社の実験によればメモリ容量当たりのトークンの処理速度(スループット)を、最大で1000倍以上に高められるという。2026年7月に開催した自然言語処理のトップ会議「ACL 2026」で発表した1)、注1)。
https://xtech.nikkei.com/atcl/nxt/mag/rob/18/012600001/00194/- 2 : 2026/08/10(月) 11:36:08.68 ID:1JFJk8Jbd
- にげろ!
- 3 : 2026/08/10(月) 11:36:19.07 ID:1JFJk8Jbd
- ドーン!
- 4 : 2026/08/10(月) 11:37:09.00 ID:jRqLbOJl0
- キャッシュ技術らしい
- 5 : 2026/08/10(月) 11:37:26.93 ID:jRqLbOJl0
- メモリ関連やばいかも
- 6 : 2026/08/10(月) 11:37:51.70 ID:X1Q9gBm50
- ボクはバンブルビー!
- 7 : 2026/08/10(月) 11:37:52.95 ID:82H2N3cWa
- 半導体バブルが終わるぞ!(願望)
- 8 : 2026/08/10(月) 11:38:30.62 ID:MhGGjX2u0
- 使用量は一切変わってねえだろ
そもそもメモリもないのにどうやってパラメーターロードするんだよ
ちょっとは考えて書け - 11 : 2026/08/10(月) 11:40:00.78 ID:jRqLbOJl0
- >>8
階層化ストレージの重複排除をそのままメモリに持ってきた感じっぽい - 17 : 2026/08/10(月) 11:43:04.52 ID:MhGGjX2u0
- >>11
違う
これはメモリあたりのスループットが向上しただけ - 21 : 2026/08/10(月) 11:46:36.65 ID:jRqLbOJl0
- >>17
帯域が限られた環境でスループットを上げるには限界がある。
PHOTONでは「そもそも消費するメモリ量(特にKVキャッシュ)を根本から削減」するアプローチを取っている - 25 : 2026/08/10(月) 11:53:27.11 ID:MhGGjX2u0
- >>21
これが解決してるのはKVキャッシュの階層化
トークンあたりのメモリ読み出しなどの最適化であって
モデルをロードする容量自体は変わらん
これで理解できないならそもそも仕組みがわかってない - 29 : 2026/08/10(月) 12:01:17.64 ID:jRqLbOJl0
- >>25
これロード時にも圧縮がかかるようになっている - 9 : 2026/08/10(月) 11:39:29.13 ID:2bam2+t10
- 計算量が増えるだけでメモリ需要は減らないやつ
- 10 : 2026/08/10(月) 11:40:00.41 ID:qT4b+up+0
- 大規模データセンターは高確率で旧式化しちまうだろうな
今のアレはコンピュータ黎明期の真空管並べてるようなもんだよ
技術進歩であっという間に陳腐化する未来しか見えない - 30 : 2026/08/10(月) 12:05:06.28 ID:AeJZ396n0
- >>10
良い例え
俺もそんな気がする - 31 : 2026/08/10(月) 12:09:56.20 ID:Dzi48YRyH
- >>10
昔でいうと80年のPC-8001から15年くらいでwindows95のPCでたくらいだから、データセンターはかなり短期間で償却してプラ転できる設計なんかな - 12 : 2026/08/10(月) 11:40:17.42 ID:69koJ6mE0
- 夢みたいなこと言ってんな
- 13 : 2026/08/10(月) 11:40:21.97 ID:ar9acMd80
- GIF JPG png 何時まで使うつもりだ
- 15 : 2026/08/10(月) 11:42:04.57 ID:+dmLzppx0
- >>13
もうローカルはwebpにしてる
引くくらい圧縮できてすごい - 16 : 2026/08/10(月) 11:42:48.26 ID:kzx0kHsla
- こういうことは日本向けの仕事だな
- 18 : 2026/08/10(月) 11:44:28.14 ID:FH2nmLOS0
- >>1
富士通すごい! - 19 : 2026/08/10(月) 11:44:57.61 ID:wE9bDakZH
- 低レイヤ領域におるける何千倍って正味アテにならんよな
特定の小さいルーチンに限れば数万倍とかアセンブラの世界だと日常茶飯事だし - 20 : 2026/08/10(月) 11:46:20.65 ID:PTyfRmEiH
- 速度が上がるならddrで行けるようになるか
- 22 : 2026/08/10(月) 11:50:35.49 ID:Zvklt2T70
- その技術で千倍メモリ積めば勝てるじゃん
- 32 : 2026/08/10(月) 12:14:21.15 ID:sg51lbz+0
- >>22
実際そういう感じだからメモリーが高騰してる
脳筋理論で性能上がっちゃうから
無限にメモリーが必要になる - 23 : 2026/08/10(月) 11:51:29.48 ID:rmRGyg1a0
- また日本の技術者がやりやがったw!
- 24 : 2026/08/10(月) 11:53:16.17 ID:7VbAQiIx0
- でも富士通でしょう?
- 26 : 2026/08/10(月) 11:57:01.36 ID:z4SqauMQM
- >>1認識錯誤を狙ったの?
富士通、Transformer系AIのメモリ使用量を最大1/1000、平均1/400にする魔改造を発表、にげて!
嫌儲

コメント