テクノロジー

GPT-6 Astraのベンチマークを徹底解説|各指標が何を測っているのかから読み解く【2026年9月】

2026年9月3日公開のGPT-6 Astraのベンチマークを公式情報で徹底解説。各指標が何を測るのかから読み解き、Claude Fable 5.1との差、飽和した3指標、注意点まで整理します。

Codexプラグイン完全ガイド|公式マーケットの180個と導入手順【2026年8月】

Codexの公式マーケットには180個のプラグインがあります。実機で全件取得しカテゴリ別に整理。導入・有効化・削除の手順、3つのマーケットの違い、IDE拡張で使えない制約まで解説。

Codex Auto-reviewの判定ポリシー完全解説|何が拒否され、どう解除するか

Codex Auto-reviewの判定ポリシーはオープンソースで全文公開。原文8,281バイトを解析し、47件のルール、risk_levelとuser_authorizationの判定表、拒否からの復帰手段まで解説します。

Qwen3.8-27Bをローカルで動かす方法|実測サイズとVRAM別の選び方【2026年8月】

Qwen3.8-27Bのウェイトが公開。全ファイルを実測しBF16は51.7GB、Q4_K_Mは15.9GBと判明。24GBのGPUで動くかを量子化別に判定し、Apache 2.0の27BとMaxのライセンス差も解説します。
AI

Devinとは?料金・使い方・Claude Code / Codexとの違いを解説【2026年8月】

Cognitionの自律型AIエンジニアDevinを公式情報で解説。2026年に刷新された料金プラン、Windsurf改めDevin Desktop、自社モデルSWE-1.7の実力、Claude Code・Codexとの違いと併用方法まで。
AI

Gemini 3.6 Flash・3.5 Flash-Lite・3.5 Flash Cyberとは?新モデル3種を解説【2026年7月】

Googleが2026年7月21日に発表したGemini 3.6 Flash・3.5 Flash-Lite・3.5 Flash Cyberを解説。ベンチマーク・料金に加え、OpenAI GPT-5.6・Claude Sonnet 5/Haiku 4.5との価格・性能比較、Flash Cyberの限定提供の背景まで公式情報に基づき整理します。
AI

Claude Mythos 5は使える?アクセス条件・参加組織・一般ユーザーの現実的な代替策【2026年7月】

Claude Mythos 5は世界約200組織限定の招待制モデルで、個人が使う方法はありません。Project Glasswingの参加条件・参加企業の最新状況と、同じ基盤モデルのFable 5でどこまで代替できるかを2026年7月時点の情報で解説します。
AI

Kimi K3はClaude Fable 5を超えたのか?ベンチマーク比較とClaude Codeで使う方法【2026年7月】

話題のKimi K3はFable 5超えなのか、第三者ベンチと公式値を区別して検証。フロントエンドでは1位・総合3位・Opus 4.8超えという実力、約1/3の料金、Claude Codeのバックエンドを差し替えて試す設定手順まで解説します。
AI

Claude Scienceの使い方|始め方・できること・研究ワークフローを実践解説【2026年7月】

Claude Scienceの実際の始め方と使い方を解説。必要なプラン・対応OSの確認、デスクトップアプリの導入、60以上のスキルを扱うコーディネーターエージェント、HPC・Modalでの計算、監査可能な成果物の活かし方までまとめます。
AI

Claude Fable 5 vs GPT-5.6(Sol)徹底比較|コーディングAIの最強はどっちか【2026年7月】

2026年7月に出揃ったClaude Fable 5とGPT-5.6 Solを徹底比較。料金はSolが半額、SWE-bench ProはFable 5が15pt差で圧勝、エージェント効率はSol優位。ベンチマークの読み方と実務での使い分けを解説します。