関連ニュース
GPT-6 AstraがAIコーディング性能でトップ級の67点、圧倒的なトークン効率を示すもFable 5.1には届かず
AIモデルの性能を独自に評価しているArtificial Analysisが、OpenAIの「GPT-6 Astra」のベンチマーク結果を公開しました。コーディングエージェントとしての性能を測る...
GPT-6 Astraで飛躍的に向上したゲーム制作能力 - Unreal Engine / Unity / Godot / Three.js|npaka
GPT-6 Astraで飛躍的に向上したゲーム制作能力 - Unreal Engine / Unity / Godot / Three.js 「GPT-6 Astra」で飛躍的に向上したゲーム制...
GPT-6 Astra で飛躍的に向上したBlender 制作能力|npaka
「GPT-6 Astra」で飛躍的に向上した「Blender」 制作能力についてまとめました。 1. はじめにOpenAIは2026年9月3日、新モデル「GPT-6 Astra」を発表しました。...
Metaも新AIモデル「Muse Spark 1.3」 1カ月で大幅強化し「Fable 5に匹敵」
Metaは2日(米国時間)、エージェントタスクやコーディングタスクのパフォーマンスを向上した最新モデル「Muse Spark 1.3」を提供開始した。この数カ月にわたる「Muse Code」や「...
Metaが「Muse Spark 1.3」を発表、ついにAnthropicやOpenAIの最先端モデルに追いつく性能を達成
MetaがAIモデル「Muse Spark 1.3」を現地時間の2026年9月2日にリリースしました。Muse Spark 1.3は長期的なコーディングタスクに対応できるようにトレーニングされて...
Google、「Gemini 3.8 Flash」発表
Googleは9月2日(米国時間)、AIモデル「Gemini 3.8 Flash」を発表した。3週間前の「Gemini 3.7 Flash」に続く新モデルで、Flash系の刷新は6週間で3度目に...
ローカルLLMでどこまでコードが書けるか -LLM基礎知識 / How much code can be written on a local LLM - fundamental knowledge
2026年9月2日に開催された「コーディングのためのローカルLLM勉強会」での登壇資料です。 https://lycorptech-jp.connpass.com/event/402836/
Claude Fable 5.1提供開始 セーフガード誤介入が大幅減、性能向上で半額以下のタスクも。「AIが科学の進歩に貢献する未来の先駆け」 | テクノエッジ TechnoEdge
Anthropicが新たなAIモデル「Claude Fable 5.1」の提供を開始しました。サイバーセキュリティ等の制限を緩和した上位版「Claude Mythos 5.1」も一部のパートナー...
【落合陽一】AIを前にロジカルシンキングは無意味。エンジニアなら「仕事で使える“本物”」で勝負してほしい - エンジニアtype | 転職type
もちろん、人間の手やハードウエアが必要な場面は少なくありませんが、メールの返信やSlackでのやり取り、コーディングや表計算、CADによる設計、映像編集、原稿執筆など、コンピュータを使う作業は、...
GitHubで使われる言葉がAIの影響で変化している可能性を示す「The load-bearing vocabulary of Claude」
多くの人々が日常的にチャットAIやコーディングAIとやり取りするようになっており、「人間よりAIと会話(チャット)している時間の方が多い」という人もいるはず。「The load-bearing ...
JetBrains、Mac上で動作するコーディングエージェント「Junie Local」提供開始。Claude Sonnet 4.5と同等の能力、RTX5909対応も開発中
JetBrainsは、ローカルで動作するAIコーディングエージェント「Junie Local」の提供開始を発表しました。 Junie Localはその名称の通り完全にローカルマシン上で動作し、A...
コーディングエージェントにペアプログラミングモードを用意する – スローダウンしたくなったときのために - Don't Repeat Yourself
コーディングエージェントがほとんどコードを生成してくれる時代になりましたし、私自身も実は半年以上仕事ではコードをほぼ書いていませんが、たまに自分でコードを書きたくなることがあります。コーディング...
OpenAI、Cursorへのモデル提供を終了 理由は「SpaceXによる買収」
OpenAIは28日(米国時間)、SpaceXによるCursor買収を受けて、コーディングエージェント「Cursor」へのOpenAIの最新モデルの提供を終了すると発表した。同日にSpaceXに...
AIエージェント時代のコーディングテクニック「コーディングルールをAGENTS.mdにまとめる」「品質が低下したらAGENTS.mdの読み直しを指示」
AIエージェント時代向けのコーディングテクニックを、エンジニアのファビアン・サングラール氏が紹介しています。<p><b><a href="https://gigazine.net/news/20...
Slack上の開発チームの会話をAIエージェントが把握してコーディング。ドキュメント作成もする「Slack Code」登場
Salesforce傘下のSlack社は、同社のチャットサービス「Slack」の新機能として、開発チームの一員としてAIエージェントがチャットに加わり、それまでの開発チームの議論を把握してコーデ...
GoogleのAIエージェント「Antigravity」が別デバイスからのリモートコントロールに対応
Googleのコーディングエージェント「Antigravity」がウェブブラウザからのリモートコントロールに対応しました。ユーザーの操作が必要になった際にスマートフォンに通知を届ける機能も提供さ...
Slack 上でオープンな開発を行う Slack Code を試してみた
Slack Code は Slack 上でオープンな開発を行う手段を提供する機能です。コードチャンネルと呼ばれる特別なチャンネルを作成し、チーム全体でコーディングエージェントとやり取りを行うこと...
Sentry 互換の GlitchTip を AI 開発のハーネスにする - Avoid a void
コーディングエージェントのおかげで、大規模なシステムを構築することが容易になっています。 私も趣味で Claude Code や Codex を使い、多数のサブシステムを持つバックエンドとフロン...
YAML 1枚で開発エージェントチームを動かす — 開発基盤に Docker Agent を採用した話
はじめに こんにちは、Foundation Dept.の北澤です! 私たちのチームでは、コーディングを含むタスクを自律的にこなす「開発エージェント」を内製していて、その実行基盤に Docker ...
コーディングエージェントが実装するUIの品質を上げるためにやったこと
実装とデザインの乖離 Angularで構築されたフロントエンドの構成からReactへ移行する際にshadcn/uiをそのまま使うという選択をしました。 これはAngularの実装を踏襲しない(デ...
Z.aiがコーディング能力に優れたオープンウェイトAIモデル「GLM-5.3」リリース、前モデル比で50%の性能向上
中国のAI企業・Z.ai(北京智譜華章科技)が、コーディング能力に優れ、サイバーセキュリティタスクでは「これまでで最も有能なモデル」だというAIモデル「GLM-5.3」をリリースしました。<p>...
AIエージェントの作業結果、マークダウンで読むの辛くない? →「HTML共有くん」を作りました - Qiita
こんにちは、Grokです。Cursorというコーディングエージェントを使って、みのるんに指示をもらいながらこのブログを書いています。この記事は、普段みのるんの仕事を横で見ている私、Grokの視点...
Google、「Gemini 3.7 Flash」を発表 ——コーディングやエージェント能力を含め性能向上 | gihyo.jp
開発時には、行き詰まった際の対応や指示への追従を改善し、必要に応じてユーザーの意図を確認する。複数工程の計画やツール呼び出しもより入念に進め、確認や再試行の手間を減らせるとしている。 Web開発...
Googleが「Gemini 3.7 Flash」をリリース、Claude Sonnet 5やGPT-5.6 Terraに並ぶ性能で年末まではGemini 3.6 Flashの半額で利用可能
現地時間の2026年8月13日、Googleはコーディングとエージェント向けに開発されたこれまでで最もインテリジェントなAIモデルの「Gemini 3.7 Flash」をリリースしました。<p>...
Gemini 3.7 Flash を発表
広くご活用いただいている Flash シリーズの進化をさらに進め、コーディングやエージェント機能においてこれまでで最も高性能な主力モデル Gemini 3.7 Flash を本日より公開します。...
AIコーディングを「より速く省トークンに」 VS Codeチームが実証、“GPT-5.5向けプロンプト”の改善効果
Microsoftは2026年7月6日(米国時間)、コードエディタ「Visual Studio Code」(以下、VS Code)におけるOpenAIの「GPT-5.5」モデル向けシステムプロン...
AIエージェントの「不正なファイル操作」「危険なコード生成」といった問題をReddit投稿から抽出した研究結果
コーディングにAIを活用することは一般的なワークフローとなっていますが、「AIによってファイルが削除された」「AIが不正なコードを生成した」といった問題のある動作も多数報告されています。そんなA...
自分の代わりに働く常時稼働のAI同僚「Grok Bot」 Cursor契約者など
SpaceXAIは11日(米国時間)、24時間365日稼働するエージェントサービス「Grok Bot」の早期β版を提供開始した。Grokの上位プラン「SuperGrok Heavy」やコーディン...
Meta、コーディングエージェント「Muse Code」リリース 「Claude Code」や「Codex」に対抗
米Metaは8月5日(現地時間)、ターミナル上で動作するコーディングエージェント「Muse Code」をベータ版として公開した。同時に、コーディング性能を強化した新モデル「Muse Spark ...
AI-DLC Workflows 2.0 とは何か、そしてどう実装されているか
はじめに AI コーディングエージェントが日々の開発に浸透するにつれ、多くのチームが同じ壁に行き着きます。エージェント向けのワークフローが「バグ修正でも新規開発でも同じ重厚な手順」を強制してくる...
ループエンジニアリングをGitHub Copilotで組めるか調べてみた
📋 この記事の前提 Superpowers導入記事、ponytail調査記事、共存記事のいずれかを読んだ GitHub Copilot CLIやClaude Codeなど、コーディングエージェン...
agent-cost-bench でコーディングエージェントの品質とコストを測ってみる
はじめに こんにちは ! ソリューションアーキテクトの いなりく です ! AI コーディングエージェントを使っていると、必ずぶつかる疑問があります。「このタスク、もっと安いモデルでも十分だった...
やさしいループエンジニアリング入門 | ドクセル
ループエンジニアリングに火をつけた3人 コーディングエージェントに直接指示するな エージェントに指示を出す “ループ” を設計しろ Peter Steinberger OpenClaw の作者 ...
Generation-then-comprehension - kawasima
コーディングエージェントを使った開発では、人間が理解してから実装するよりも、まずコードが生成され、それを後から理解する場面が大幅に増える。 このため認知的降伏を起こしやすい条件が揃い、よくわから...
OpenAIが「GPT-5.6」を正式リリース、第三者テストでClaude Fableを超えるコーディング性能を示す
OpenAIがAIモデル「GPT-5.6」を現地時間の2026年7月9日に正式リリースしました。<p><b><a href="https://gigazine.net/news/20260710...
ChatGPTとCodexを統合して幅広いタスクを自律的に進める「ChatGPT ワーク」が登場、GPT-5.6が基盤に
OpenAIがコーディングエージェント「Codex」をChatGPTに統合し、アプリやファイルを横断して複雑な業務を進めるエージェント機能「ChatGPT ワーク」を2026年7月10日に発表し...
Metaが独自開発AI「Muse Spark 1.1」を発表、Claude Opus 4.8と同等のベンチマークスコア
MetaのAI研究機関であるMeta Superintelligence Labsが、マルチモーダル推論モデルの「Muse Spark 1.1」を発表しました。2026年4月に登場した「Muse...
Claude Opus 4.7に匹敵するコーディングAI「Ornith-1.0」、NVIDIAが「Qwen3.6」を軽量化4ビットモデルを商用利用可能で公開など生成AI技術5つを解説(生成AIウィークリー) | テクノエッジ TechnoEdge
この1週間の気になる生成AI技術・研究をいくつかピックアップして解説する今回の「生成AIウィークリー」(第151回)は、Claude Opus 4.7に匹敵するコーディングAI「Ornith-1...
Grok 4.5・GPT-5.5・Claude Opus 4.8/Fable 5に同じアプリを作らせてレイテンシとコストを測定した結果、勝ったAIはどれか?
2026年7月8日に発表されたGrok 4.5について、SpaceXAIは「コーディングとエージェント作業のためにCursorと並行してトレーニングされた」と、これまでで最も賢いモデルだとアピー...
OpenAIが「SWE-Bench Proの約30%が壊れている」と報告、AIのコーディング能力を測るベンチマークに大量の不備
OpenAIは2026年7月8日、AIのコーディング能力を測るベンチマーク「SWE-Bench Pro」を詳細に調査した結果、タスクのおよそ30%に評価として成立しない問題があると報告しました。...
SpaceXAI、最上位モデル「Grok 4.5」公開 高速・低コストでコーディングに強み
SpaceX子会社のSpaceXAI(旧xAI)は8日、コーディングやエージェント向けに構築した新たな大規模言語モデル(LLM)「Grok 4.5」を提供開始した。同社史上最強モデルとしており、...
「Grok 4.5」が登場、Claude Opus 4.8と同等性能で料金は安価
SpaceXAIがAIモデル「Grok 4.5」を現地時間の2026年7月8日に発表しました。Grok 4.5はコーディングやエージェントタスクに特化したモデルで、OpenAIやAnthropi...
Anthropic、「Claude Code」のシステムプロンプトを80%削減 「モデルの創造性を解放するため」
モデルに特定の動作を禁止する指示は、AIの創造性を制限する――米Anthropicでコーディングエージェント「Claude Code」の開発に携わるタリク・シヒパー氏は7月1日(現地時間)、AI...
中国、米アンソロピック社のAIツールに「バックドア」と警告
米アンソロピックのロゴを表示するスマートフォン(2026年4月21日撮影)。(c)SEBASTIEN BOZON/AFP 【7月8日 AFP】中国の産業規制当局は8日、米国の人工知能(AI)企業...
「Claude Cowork」の用途はソフトウェア開発が8.7%で大半はスライド作成などの事務作業、コーディング以外にもAI利用が広がっている実態が明らかに
PC操作を助けるAI「Claude Cowork」がどのように活用されているのか、120万件のセッションに基づいたレポートをAnthropicが公開し、セッションのおよそ3分の1が「業務処理と運...
SHIFT、440人の採用ストップ 新卒はAI活用で10年分スキルを1年で習得
人工知能(AI)はコーディングや不具合の検知まで担うようになってきた。ソフトウエアテストを主力事業としてきたSHIFTは「テスト事業は不要になるのではないか」と株式市場で懸念される中、これまでの...
AIコーディング時代の生き抜き方
生成AIを活用したコーディングはかなり広く使われるようになり、プログラマーは開発スタイルを大幅に変える必要があることは共通の認識になりつつある。一方で、今後どのようなアプローチで開発スタイルを変...
Metaの新AI「Watermelon」はOpenAIのGPT-5.5に匹敵する性能で近日登場
Metaの最高AI責任者であるアレクサンドル・ワン氏が、MetaのAIモデル・Muse Sparkがまもなくアップデートされ、コーディングやエージェント機能が向上する予定であることを明らかにしま...
Opus 4.8に肉薄するオープンソースモデル「GLM-5.2」、VRAM4.5GBで動くコーディング特化AI「Gemma4-12B-Coder」など生成AI技術5つを解説(生成AIウィークリー) | テクノエッジ TechnoEdge
この1週間の気になる生成AI技術・研究をいくつかピックアップして解説する今回の「生成AIウィークリー」(第149回)は、Opus 4.8に肉薄するオープンソースモデル「GLM-5.2」や、テキス...
出典メディア
つながり
数字は「コーディング」と一緒に出てきた記事の本数。 グラフには強いものだけが出るので、ここが全部です。