富士通、AIのTransformer層の差し替えだけで「メモリ使用量1/10」「処理速度475倍」になる魔改造を発表

1 : 2026/08/10(月) 12:05:08.47 ID:WF63qC790

AIの基盤モデルの高性能化を巡り、世界中で競争が激化している。Noetra(ノエトラ)に代表されるように、日本でも国産モデル開発の機運が高まってきた。ただし、研究開発でも巨額の投資でも大幅に先行する米国や中国に、日本が伍していくのは容易ではない。そこで重要になるのが、より少ない計算資源で、より高い性能を見込める独自の技術である。

その候補の一つになりうる新たなアーキテクチャを富士通が開発した。既存のLLM(大規模言語モデル)ベースの基盤モデルが利用するTransformerのメモリの利用効率を大幅に高める「PHOTON」と呼ぶ技術である。

同社の実験によればメモリ容量当たりのトークンの処理速度(スループット)を、最大で1000倍以上に高められるという。

2026年7月に開催した自然言語処理のトップ会議「ACL 2026」で発表した1)、注1)。
https://xtech.nikkei.com/atcl/nxt/mag/rob/18/012600001/00194/

レス1番のリンク先のサムネイル画像
2 : 2026/08/10(月) 12:05:33.73 ID:WF63qC790
「横じゃなく、縦。」富士通の新構造AI「PHOTON」がTransformerの常識を壊す——処理効率475倍の正体と、日本が本気で勝ちにいく理由
https://note.com/allay0224/n/n3c4800eaa29f
3 : 2026/08/10(月) 12:06:11.59 ID:hVHDxNyF0
>>2
国産化だけ教えて

笑えるか笑えないか

4 : 2026/08/10(月) 12:06:31.89 ID:WF63qC790
必要なメモリが1/10に
メモリ帯域の問題が解決して475倍速に
5 : 2026/08/10(月) 12:06:57.13 ID:WF63qC790
マグナRAMのようなもの
6 : 2026/08/10(月) 12:07:13.03 ID:WF63qC790
RAMダブラーのようなもの
7 : 2026/08/10(月) 12:07:42.49 ID:51DlExhc0
トークン節約できるのは大きいけど、とういう技術?
AIに要約して貰うか
8 : 2026/08/10(月) 12:07:55.32 ID:HyaeutwW0
せっかくこういうの技術者が考えるのに文系のアホ経営陣のゲェジのせいで
技術が海外に流出してるイメージ
31 : 2026/08/10(月) 12:27:48.00 ID:2yfM4Df/0
>>8
特許取るに決まってるだろ
9 : 2026/08/10(月) 12:09:44.77 ID:2a7UosaH0
新しいことより既存のをまともに作れるようになれよ
10 : 2026/08/10(月) 12:11:31.34 ID:dD08Se3q0
ノエトラって成功すんのかあれ
11 : 2026/08/10(月) 12:11:46.51 ID:zbdFPDl50
数字ばっかり一人歩きして使えない技術が富士通多いよな
12 : 2026/08/10(月) 12:14:26.39 ID:lhJAkANj0
某動画で「勝ったも同然」て連呼してて草だった
何にいつ勝つんですか?
13 : 2026/08/10(月) 12:14:40.45 ID:GK+IABhs0
>>1
省電力化は日本の得意分野だからマジで頑張ってほしいな

問題はLLMの成長が止まりつつあって
AI開発が他の方法にシフトしていくスピードが速いと
せっかく省電力化しても誰ももう使わないみたいになっちゃうリスクが(´・ω・`)

14 : 2026/08/10(月) 12:16:11.63 ID:JbgyNlxO0
vram4gbでもローカルLLMを動作させられるようになつのか
17 : 2026/08/10(月) 12:19:46.07 ID:lhJAkANj0
>>14
推論の過程の話だからならんやろ
結局はそれなりのモデルをvramにロードしない事には始まらん
16 : 2026/08/10(月) 12:18:08.66 ID:NruBruQ/0
うさんくさい
18 : 2026/08/10(月) 12:20:10.13 ID:ee4mgQN50
AMDのCPUで鉛筆で線引くとクロック上がるみたいなやつ?
19 : 2026/08/10(月) 12:20:14.24 ID:2a7UosaH0
経産省がAIに金ばらまくから
どーせ突貫で考えただろ
32 : 2026/08/10(月) 12:28:25.38 ID:2yfM4Df/0
>>19
そんなものを国際会議で発表するわけないだろ
そんなことしたら大問題だ
20 : 2026/08/10(月) 12:20:56.90 ID:u19C6GkL0
でも激アツになるんでしょう?
21 : 2026/08/10(月) 12:21:43.10 ID:VKXQLPw40
新しく産み出す事は苦手だけど変態魔改造だけは得意な日本らしい
22 : 2026/08/10(月) 12:22:59.88 ID:xkqW7aIz0
本当に有用な技術ならすぐに真似されて追いつかれる
優位性と言っても長くは持たないだろう
23 : 2026/08/10(月) 12:23:19.31 ID:MlLhAjAn0
中国もNvidiaのチップに比べて糞遅い国産チップをいかに効率よく単純な性能以上に活用できる技術開発してるし
豊富な資金と力業で対抗できない国は技術で対抗するしかないからな
27 : 2026/08/10(月) 12:24:13.75 ID:lhJAkANj0
>>23
中華は既に使えるもん出してるしな
もはや日本は口だけで悲しい
24 : 2026/08/10(月) 12:23:41.36 ID:2HEev+Lb0
逆にメモリの容量をおもいっきり使って処理能力をさらに倍の倍の倍になったりとかせんの?
25 : 2026/08/10(月) 12:23:46.28 ID:XYkmtnCU0
成功したらまたアメリカに潰されそう
26 : 2026/08/10(月) 12:23:48.20 ID:jEGOrt7E0
縦型メモリハード限定?
28 : 2026/08/10(月) 12:24:13.91 ID:7WM6kaYm0
カスタムノードやアプリでロールアウトして利用者囲い込めばええんちゃうか?
29 : 2026/08/10(月) 12:24:31.28 ID:7fZWk2xc0
今日のジャッぷ企業お得意、いつものウソ・大げさ・まぎらわしい
30 : 2026/08/10(月) 12:26:37.56 ID:vqnBLVGZ0
よくわからんけど、メモリ安くしてくれ
33 : 2026/08/10(月) 12:28:41.50 ID:NE3Xvzl+0
日本すごいは日本でしか通用しない。
34 : 2026/08/10(月) 12:29:41.40 ID:51DlExhc0
もともとPHOTONはメモリ効率を優先した軽量な設計になっているため、単発の推論では従来のTransformerより若干精度が落ちる。その精度低下を補うために、複数解釈を並列で走らせて多数決を取る、という位置づけです。

同じGPUメモリで通常なら1つしか走らせられない推論を、複数同時に並列実行できる。この「同じメモリ予算でたくさん処理できる」効率化こそが475倍という数字の正体です。

35 : 2026/08/10(月) 12:31:46.56 ID:6k/1Bjqi0
で、関係するエンジニアは今の報酬の20倍の金額で海外に引き抜かれると。
36 : 2026/08/10(月) 12:35:53.06 ID:ljrPTczN0
サイバトロン派
37 : 2026/08/10(月) 12:38:06.09 ID:52bEtoUd0
マジで頑張ってほしい
国産AIが米中に追いつき追い越すには圧倒的な効率化という方向を目指すしかない
基礎技術ではすでに勝負付いてるからな

コメント

タイトルとURLをコピーしました