関連ニュース
iPhone 18 Proに搭載されるA20 Proチップのベンチマーク結果が流出、CPUは前世代よりも約25%高速化でGPUスコアも約40%向上
AppleがiPhone DuoやiPhone 18 Pro/Pro Maxに搭載した新型SoC「A20 Pro」のGeekbench 6における測定結果が登場しました。シングルコアとマルチコア...
画面が回転するノートPC「VAIO T」のベンチマークテストを実行してみた&バッテリー持続時間も検証してみたよレビュー
マルチフリップ機構を搭載したノートPC「VAIO T」が2026年9月11日に登場します。画面を回転させて「ノートPCモード」「ビューモード」「タブレットモード」を切り替えられる個性的なPCで、...
小型かつ高性能で日本語応答も可能な中国製AIモデル「MiniCPM5-2B」が登場、2BモデルなのにGemma 4 12Bと同等のベンチマークスコア
中国のAI企業であるOpenBMBがAIモデル「MiniCPM5-2B」を2026年9月7日に公開しました。MiniCPM5-2Bは20億パラメーター規模のモデルですが、40億パラメーター規模の...
GPT-6 AstraがAIコーディング性能でトップ級の67点、圧倒的なトークン効率を示すもFable 5.1には届かず
AIモデルの性能を独自に評価しているArtificial Analysisが、OpenAIの「GPT-6 Astra」のベンチマーク結果を公開しました。コーディングエージェントとしての性能を測る...
BraveがChrome・Edge・Firefoxを速度と性能の両方で上回っているというベンチマーク結果を公開
ウェブブラウザ・Braveが広く使われているライバルであるChrome、Edge、Firefoxとのベンチマーク比較結果を公開しました。テストによると、Braveは他の3つのブラウザに比べてCP...
Metaも新AIモデル「Muse Spark 1.3」 1カ月で大幅強化し「Fable 5に匹敵」
Metaは2日(米国時間)、エージェントタスクやコーディングタスクのパフォーマンスを向上した最新モデル「Muse Spark 1.3」を提供開始した。この数カ月にわたる「Muse Code」や「...
Metaが「Muse Spark 1.3」を発表、ついにAnthropicやOpenAIの最先端モデルに追いつく性能を達成
MetaがAIモデル「Muse Spark 1.3」を現地時間の2026年9月2日にリリースしました。Muse Spark 1.3は長期的なコーディングタスクに対応できるようにトレーニングされて...
DeepSeekが画像認識に対応した「DeepSeek-V4-Flash-Vision-Exp」をオープンモデルとして公開、画像認識を含むタスクでClaude Opus 4.8と同等の性能
中国企業のDeepSeekが「DeepSeek-V4-Flash-Vision-Exp」をオープンモデルとして公開しました。DeepSeek-V4-Flash-Vision-ExphはDeepS...
「Pixel 11」「Pixel 11 Pro」「Pixel 11 Pro Fold」のベンチマークスコア&バッテリー持続時間&充電速度を実際に検証してみたよレビュー
2026年8月12日にGoogle製スマートフォン「Google Pixel 11」「Google Pixel 11 Pro」「Google Pixel 11 Pro XL」「Google Pi...
Cloudflareが1.1.1.1のDNSキャッシュを数十バイト単位で削り込んで100TBのメモリを節約
CloudflareがパブリックDNSリゾルバー「1.1.1.1」などで使われているDNSキャッシュのデータ構造を見直し、システム全体で約100TBのメモリを削減したと発表しました。ベンチマーク...
OpenAIがカスタム推論チップ「Jalapeño」のベンチマーク結果を公開、高スループットと低レイテンシを単一アーキテクチャで両立
OpenAIがBroadcomと共同開発した推論システム向けカスタムチップ「Jalapeño(ハラペーニョ)」についてのブリーフィングを行い、ベンチマークスコアを公表しました。Jalapeñoは...
OpenAI、自社チップ「ハラペーニョ」の性能を公表 電力効率やレイテンシ向上
OpenAIは25日(米国時間)、自社開発の推論プラットフォームとして設計した新チップ「Jalapeño」(ハラペーニョ)の実測のベンチマーク結果を公開した。
各種AIのiPhoneでの動作性能を測定した結果がArtificial Analysisによって公開される、コンテキスト長や応答時間を制限して実環境に近い性能を測定
ローカルで実行可能なAIモデルの中にはスマートフォンでの動作も可能な小型モデルも存在します。新たに、AIの性能分析を行っているArtificial Analysisが「iPhone 17 Pro...
NVIDIAのAIエージェント「AVO」がARC-AGI-3で100%を達成、同じベースモデルの別条件での評価は約30%で「実行基盤(ハーネス)」の重要性が示される
NVIDIAが開発するAIエージェントシステム「Agentic Variation Operators(AVO)」が、AIが未知の環境とやり取りしながら推論する能力を測るベンチマーク「ARC-A...
オープンモデルの「Gemma 4 31B」がタスクによっては「Claude Sonnet 5」と同じ品質を40分の1のコストで実現可能
次々に新たなAIモデルが登場してベンチマークスコアの最高記録を更新し続けていますが、タスクによってはそれほど高性能なAIでなくとも十分な場合が多々あります。AIを活用した文書管理サービスを開発す...
250K Plus&RTX 5070 Ti搭載ゲーミングPCの性能を検証!Forza Horizon 6は4Kでも快適に遊べる?
<p><img src="https://ascii.jp/img/2026/08/19/4514652/s/73689b7d7503c083.jpg" width="60" height="6...
テオ氏:アップルのファイルシステムは遅すぎる——AIコーディングを全てLinuxに移行し、ストレージを3分の1に削減 — BigGo ファイナンス
テオ氏:アップルのファイルシステムは遅すぎる——AIコーディングを全てLinuxに移行し、ストレージを3分の1に削減 ソフトウェア開発者のテオ氏は、自身のポッドキャストのソロ回で、ベンチマークに...
AIモデル「Ornith-1.5」が登場、Claude Opus 4.8級の大型モデルからスマホ動作可能な軽量モデルまで網羅したオープンモデル
AI研究組織のOrnithがAIモデル「Ornith-1.5」を2026年8月19日に公開しました。Ornith-1.5は「Ornith-1.5-397B」「Ornith-1.5-35B-A3B...
DeepSeek V4 Flashはベンチマークスコアは高いが実際のタスクでは苦戦しているという指摘、オーケストレーションに課題
中国のAI企業・DeepSeekは高性能AIモデル「DeepSeek-V4 Flash」と「DeepSeek-V4 Pro」を展開しています。V4 Flashは登場以来「安価かつ高性能」として利...
ローカルで動かせる「Qwen3.8-27B」が無償公開、一部ベンチマークでClaude Opus 4.6 Max超え
アリババのQwenチームが270億パラメーターのAIモデル「Qwen3.8-27B」を公開しました。モデルのウェイトはApache License 2.0で公開されており、条件を守れば商用利用も...
トランプモバイルのスマホ「T1」実機テストでベンチマーク・バッテリー・画面輝度などの計測結果が明らかに
トランプ・オーガナイゼーションが立ち上げた携帯電話事業「トランプ・モバイル」から登場した最初のスマートフォン「T1」を詳しく調査する記事が公開されました。以前の調査でT1はほぼ「HTC U24 ...
Metaが独自開発AI「Muse Spark 1.1」を発表、Claude Opus 4.8と同等のベンチマークスコア
MetaのAI研究機関であるMeta Superintelligence Labsが、マルチモーダル推論モデルの「Muse Spark 1.1」を発表しました。2026年4月に登場した「Muse...
OpenAIが「SWE-Bench Proの約30%が壊れている」と報告、AIのコーディング能力を測るベンチマークに大量の不備
OpenAIは2026年7月8日、AIのコーディング能力を測るベンチマーク「SWE-Bench Pro」を詳細に調査した結果、タスクのおよそ30%に評価として成立しない問題があると報告しました。...
「Grok 4.5」が登場、Claude Opus 4.8と同等性能で料金は安価
SpaceXAIがAIモデル「Grok 4.5」を現地時間の2026年7月8日に発表しました。Grok 4.5はコーディングやエージェントタスクに特化したモデルで、OpenAIやAnthropi...
出典メディア
つながり
数字は「ベンチマーク」と一緒に出てきた記事の本数。 グラフには強いものだけが出るので、ここが全部です。