関連ニュース
GitHub - FlashML-org/FreeToken
| Download | Paper | Developer Slack | Community Discord | Community WeChat | Unlock datacenter-c...
はてなテクノロジー
08/23 09:18
FreeToken の概要|npaka
「FreeToken」の概要についてまとめました。 1. FreeToken「FreeToken」は、NVIDIA GPUで、VRAMに収まりきらない大型MoE(Mixture-of-Exper...
はてなテクノロジー
08/23 06:39
RTX 5090でFreeTokenを試してみた。35Bでは不要、120B級MoEでは話が変わる
2026年8月22日時点のFreeToken 0.1.2を、RTX 5090 32GBとRAM 128GBのPCで試しました。 FreeTokenは、Mixture-of-Experts(MoE...
はてなテクノロジー
08/22 10:40
約332億パラメータのDense型LLM「LLM-jp-4 33B」モデルを公開 - LLM-jp
大規模言語モデル研究開発センター(LLMC)では、オープンかつ日本語に強い大規模言語モデルの開発を進めており、2026年4月には、Dense型の「LLM-jp-4 8B」モデルと、Mixture...
はてなテクノロジー
08/19 04:24
出典メディア
はてなテクノロジー (5)
つながり
数字は「MoE」と一緒に出てきた記事の本数。 グラフには強いものだけが出るので、ここが全部です。
Mixture
4
FreeToken
4
Mixture-of
3
Mixture-of-
3
サブカル全般
3
キャッシュ
2
GPU
2
ホストRAM
1
NVIDIA
1
規模言語モデル
1
ローカル推論
1
規模言語
1
LLMC
1
AI推論エンジン
1
MoE特
1
llama.
1
Discord
1
、FlashML-org
1
、FlashML-
1
実行環境
1
Run
1
speeds.
1
|、Unlock
1
、LLM-jp
1
edge-native
1
パラメータ
1
datacenter-
1
LLM-jp-
1
サービングエンジン
1
|、Developer
1
高速化
1
AI・人工知能
1
120B級MoE
1
MoE特化
1
、LLM-
1
RTX
1
32GB
1
edge-
1
巨...
1
高速動作
1