富士通、Transformer系AIのメモリ使用量を最大1/1000、平均1/400にする魔改造を発表、にげて!

1 : 2026/08/10(月) 11:35:59.23 ID:1JFJk8Jbd

AIの基盤モデルの高性能化を巡り、世界中で競争が激化している。Noetra(ノエトラ)に代表されるように、日本でも国産モデル開発の機運が高まってきた。ただし、研究開発でも巨額の投資でも大幅に先行する米国や中国に、日本が伍していくのは容易ではない。そこで重要になるのが、より少ない計算資源で、より高い性能を見込める独自の技術である。

その候補の一つになりうる新たなアーキテクチャを富士通が開発した。既存のLLM(大規模言語モデル)ベースの基盤モデルが利用するTransformerのメモリの利用効率を大幅に高める「PHOTON」と呼ぶ技術である。同社の実験によればメモリ容量当たりのトークンの処理速度(スループット)を、最大で1000倍以上に高められるという。2026年7月に開催した自然言語処理のトップ会議「ACL 2026」で発表した1)、注1)。
https://xtech.nikkei.com/atcl/nxt/mag/rob/18/012600001/00194/

レス1番のリンク先のサムネイル画像
2 : 2026/08/10(月) 11:36:08.68 ID:1JFJk8Jbd
にげろ!
3 : 2026/08/10(月) 11:36:19.07 ID:1JFJk8Jbd
ドーン!
4 : 2026/08/10(月) 11:37:09.00 ID:jRqLbOJl0
キャッシュ技術らしい
5 : 2026/08/10(月) 11:37:26.93 ID:jRqLbOJl0
メモリ関連やばいかも
6 : 2026/08/10(月) 11:37:51.70 ID:X1Q9gBm50
ボクはバンブルビー!
7 : 2026/08/10(月) 11:37:52.95 ID:82H2N3cWa
半導体バブルが終わるぞ!(願望)
8 : 2026/08/10(月) 11:38:30.62 ID:MhGGjX2u0
使用量は一切変わってねえだろ
そもそもメモリもないのにどうやってパラメーターロードするんだよ
ちょっとは考えて書け
11 : 2026/08/10(月) 11:40:00.78 ID:jRqLbOJl0
>>8
階層化ストレージの重複排除をそのままメモリに持ってきた感じっぽい
17 : 2026/08/10(月) 11:43:04.52 ID:MhGGjX2u0
>>11
違う
これはメモリあたりのスループットが向上しただけ
21 : 2026/08/10(月) 11:46:36.65 ID:jRqLbOJl0
>>17
帯域が限られた環境でスループットを上げるには限界がある。
PHOTONでは「そもそも消費するメモリ量(特にKVキャッシュ)を根本から削減」するアプローチを取っている
25 : 2026/08/10(月) 11:53:27.11 ID:MhGGjX2u0
>>21
これが解決してるのはKVキャッシュの階層化
トークンあたりのメモリ読み出しなどの最適化であって
モデルをロードする容量自体は変わらん
これで理解できないならそもそも仕組みがわかってない
29 : 2026/08/10(月) 12:01:17.64 ID:jRqLbOJl0
>>25
これロード時にも圧縮がかかるようになっている
9 : 2026/08/10(月) 11:39:29.13 ID:2bam2+t10
計算量が増えるだけでメモリ需要は減らないやつ
10 : 2026/08/10(月) 11:40:00.41 ID:qT4b+up+0
大規模データセンターは高確率で旧式化しちまうだろうな
今のアレはコンピュータ黎明期の真空管並べてるようなもんだよ
技術進歩であっという間に陳腐化する未来しか見えない
30 : 2026/08/10(月) 12:05:06.28 ID:AeJZ396n0
>>10
良い例え
俺もそんな気がする
31 : 2026/08/10(月) 12:09:56.20 ID:Dzi48YRyH
>>10
昔でいうと80年のPC-8001から15年くらいでwindows95のPCでたくらいだから、データセンターはかなり短期間で償却してプラ転できる設計なんかな
12 : 2026/08/10(月) 11:40:17.42 ID:69koJ6mE0
夢みたいなこと言ってんな
13 : 2026/08/10(月) 11:40:21.97 ID:ar9acMd80
GIF JPG png 何時まで使うつもりだ
15 : 2026/08/10(月) 11:42:04.57 ID:+dmLzppx0
>>13
もうローカルはwebpにしてる
引くくらい圧縮できてすごい
16 : 2026/08/10(月) 11:42:48.26 ID:kzx0kHsla
こういうことは日本向けの仕事だな
18 : 2026/08/10(月) 11:44:28.14 ID:FH2nmLOS0
>>1
富士通すごい!
19 : 2026/08/10(月) 11:44:57.61 ID:wE9bDakZH
低レイヤ領域におるける何千倍って正味アテにならんよな
特定の小さいルーチンに限れば数万倍とかアセンブラの世界だと日常茶飯事だし
20 : 2026/08/10(月) 11:46:20.65 ID:PTyfRmEiH
速度が上がるならddrで行けるようになるか
22 : 2026/08/10(月) 11:50:35.49 ID:Zvklt2T70
その技術で千倍メモリ積めば勝てるじゃん
32 : 2026/08/10(月) 12:14:21.15 ID:sg51lbz+0
>>22
実際そういう感じだからメモリーが高騰してる
脳筋理論で性能上がっちゃうから
無限にメモリーが必要になる
23 : 2026/08/10(月) 11:51:29.48 ID:rmRGyg1a0
また日本の技術者がやりやがったw!
24 : 2026/08/10(月) 11:53:16.17 ID:7VbAQiIx0
でも富士通でしょう?
26 : 2026/08/10(月) 11:57:01.36 ID:z4SqauMQM
>>1認識錯誤を狙ったの?

コメント

タイトルとURLをコピーしました