関連ニュース
LLM-jp-4-VL 9Bリリース - LLM-jp
著者: 杉浦一瑳とLLM-jpマルチモーダルWGチーム 概要 このたびLLM-jpは視覚言語モデル LLM-jp-4-VL 9B を公開しました。 LLM-jp-4-VL 9Bは、国産大規模言語...
Anthropic、「Claude Fable 5.1」と「Claude Mythos 5.1」発表 「監視の難しさ」への懸念も開示
米Anthropicは9月1日(現地時間)、大規模言語モデル「Claude Fable 5.1」と「Claude Mythos 5.1」を発表した。両者は同一のモデルで、適用されるセーフガードの...
アリババのLLM「Qwen」利用数はGoogleの5倍 中国AIとどう生きるか - 日本経済新聞
ある国内大手製造業の人工知能(AI)担当チームは、中国アリババ集団の大規模言語モデル(LLM)「Qwen(クウェン)」を現場で使っている。この企業は7月に発足した国産AI開発連合「ノエトラ」への...
一滴の水から海を知る—— 子どもはなぜAIより 速く言語を学べるのか?
<p><img src="https://ascii.jp/img/2019/11/06/1510916/s/ed8de61ce6796246.png" width="60" height="6...
4台のM5 Ultra Mac Studioで「データセンター級」メモリ帯域幅4.8TB/s 巨大LLMも高速でローカル実行可能に
Mac4台でデータセンター級のメモリ帯域幅に――複数デバイスをAIクラスタとして扱うためのOSS「exo」を開発する米EXO Labsは8月25日(現地時間)、米Appleの新チップ「M5 Ul...
「今からロボットを現場投入できないか?」 増えた日本企業からの問い合わせ “頭脳”を作る韓国企業が感じた国内の変化
現在、一般的にAIといえば、LLM(大規模言語モデル)のことを指す。次いで多くの人がイメージするのが、プロンプトにより画像や動画、音楽などを出力する生成AIだろう(なおLLMも文章を生成する生成...
【ローカルLLM】国産LLM「LLM-jp-4-33B」と「Qwen3.8-27B」の推論性能比較(RTX 5070 Ti + RTX 3070 Ti) - Qiita
はじめに 先週、LLMCが大規模言語モデル「LLM-jp-4 33B」を公開した。これは約332億パラメーターのDense型のモデルで、今年4月に公開されたMoE型のモデルのDense版に対応す...
なぜAnthropicなどAI企業は、古書を買い集め裁断し処分しているのか | Forbes JAPAN 公式サイト(フォーブス ジャパン)
作家、アーキビスト(文書や記録資料の保存を担う専門職)、歴史家、そして愛書家たちが、大手テック企業やAI開発企業に対してネット上で総攻撃を展開している。きっかけは、これらの企業が稀覯本や古書を大...
大規模言語モデル(LLM)は「次の単語を当てる」だけなのに、なぜ思考しているように見えるのか…その理由を解説したnoteに様々な反応「現代AIの本質を端的に語っている」
LLMは「次の単語を当てる」だけなのに、なぜ思考しているように見えるのか?|中島聡 これは私のメルマガ「週刊Life is beautiful」で紹介している記事の要約・解説です。要約をこちらに...
「オープンな国産モデル」に33Bパラメータの新バージョン 国立情報学研究所
国立情報学研究所(NII)は8月18日、オープンな国産大規模言語モデル(LLM)「LLM-jp-4 33B」シリーズを公開した。モデルの重みは約332億パラメータで、事後学習済みモデルは各種ベン...
約332億パラメータのDense型LLM「LLM-jp-4 33B」モデルを公開 - LLM-jp
大規模言語モデル研究開発センター(LLMC)では、オープンかつ日本語に強い大規模言語モデルの開発を進めており、2026年4月には、Dense型の「LLM-jp-4 8B」モデルと、Mixture...
楽天市場、検索AIが流通総額を押し上げ--購入意図を判別、年128億円の効果
楽天グループは8月10日、決算説明会で、「楽天市場」の検索へのAI活用の成果を説明した。LLM(大規模言語モデル)でユーザーの検索クエリの文脈を理解し、情報を集めている探索段階か、購入の意思決定...
「AIに頼りすぎた」人気ユーチューバーが反省、活動を縮小へ
ネットで精力的に活動するクリエイターのハンク・グリーン氏は、自身のAI利用をじっくり見直したと語り、「(大規模言語モデルに)助言や編集、情報源探しの面で頼りすぎていた」と認めた。<br clea...
7440億パラメーターの巨大AI「GLM-5.2」をメモリ25GBの普通のPCで動かす推論エンジン「Colibrì」が登場
7440億パラメーターを備えた大規模言語モデル「GLM-5.2」をメモリ25GBの一般向けPCで動作させる推論エンジン「Colibrì」が公開されました。VRAMやRAMにモデル全体を読み込むの...
iPhone 17 Proで270億パラメータのAI「Qwen3.6-27B」が動作、AppleはPrismMLと圧縮技術の活用を協議か
AI開発企業のPrismMLが270億個のパラメータを持つ大規模言語モデル「Qwen3.6-27B」を圧縮し、iPhone 17 Pro単体で動作させることに成功したと主張しています。また、Ap...
小規模言語モデルが最先端AIを「コスト・速度・精度」で上回る | Forbes JAPAN 公式サイト(フォーブス ジャパン)
AI競争は初日から「より大きい」ことによって定義されてきた。より多いパラメータ、より多い学習データ、より高い能力。そのすべてが、ほぼ何でもこなせる少数の最先端大規模言語モデル(LLM)へと収れん...
LLMによる情報抽出入門 | 技術評論社
著者 中田百科(なかだひゃっか),桐生佳介(きりゅうけいすけ) 著 定価 3,520円(本体3,200円+税10%) 発売日 2026.7.27 判型 B5変形 頁数 272ページ ISBN 9...
OpenAI、初の自社AIチップ「ハラペーニョ」発表 ブロードコムと共同開発
OpenAIと半導体大手のブロードコムは6月24日(米国時間)、OpenAIが設計した初のAIチップ「Jalapeño(ハラペーニョ)」を発表した。大規模言語モデル(LLM)の推論処理に特化した...
出典メディア
つながり
数字は「規模言語」と一緒に出てきた記事の本数。 グラフには強いものだけが出るので、ここが全部です。