Grok 4.5とは?Cursor共同開発のコーディング特化AIを黒焦団が見た

181 AIツール活用

黒焦団の作戦室で、今日も戦闘員が静かにコードを書いていた。そこへ総統が、やたら機嫌よく入ってきた。

総統

総統

戦闘員よ! ついに余の時代が来たのだ!
戦闘員

戦闘員

また何か変なニュース見ました?
総統

総統

SpaceXAIがGrok 4.5を出したのだ! コーディング特化AIなのだな! つまり、もう貴様はいらん!

戦闘員の顔から、すっと血の気が引いた。そこへアカネ先生がやってきた。

アカネ先生

アカネ先生

総統、いきなりリストラ宣言はやめときぃな。しかも昨日、変数名を great_soutou_final_final_true にして動かへん言うてた人が何を言うてますの。

総統の結論

総統

総統

AIが強くなっても、余の偉大なる仕様は自動で伝わらんのだな! つまり、まず要件定義をせよということなのだ。

この記事でわかること

  • Grok 4.5がどんなAIモデルとして発表されたのか
  • Cursor共同開発という点がなぜ重要なのか
  • SWE Bench Proや価格など、公表値を見る時の注意点
  • 仕事で使うならどんな作業に向いていそうか
  • AIコーディング時代に人間側へ残る役割

Grok 4.5とは?

Grok 4.5は、SpaceXAIが発表したコーディング・エージェント特化モデルです。報道や発表情報では、Cursorと共同で開発され、SpaceXAIコンソール、Grok Build、Cursorから利用できるとされています。

特徴としては、SWE Bench Proで64.7%、推論速度80 tokens/秒、価格は入力100万トークンあたり2ドル、出力100万トークンあたり6ドルとされており、かなり「実務で長く回す」ことを意識したモデルに見えます。

ここで大事なのは、Grok 4.5が単なるチャットAIではなく、コーディング作業を進めるエージェント向けに出てきた点です。バグ修正、複数ファイルの変更、テスト作成、リファクタリング、仕様の読み取り。こういう作業をAIに任せる流れが、さらに強くなってきたということやね。

総統

総統

つまり余が『世界征服アプリを作れ』と言えば完成するのだな!
戦闘員

戦闘員

完成しません。
総統

総統

なぜだ!
戦闘員

戦闘員

仕様がないからです。
アカネ先生

アカネ先生

AIが賢くなっても、総統の頭の中にしかないふわふわ計画までは読めへんのよ。Grok 4.5が強くても、要件が『余の偉大さを感じる感じ』では、そら困りますわ。

Cursorとの共同開発が意味すること

Grok 4.5で注目したいのは、Cursorとの関係です。Cursorは実際の開発ワークフローに深く入り込んでいるAIコードエディタなので、そこで得られる使い方や課題をモデル側に反映できるなら、かなり実務寄りの進化が期待できます。

AIコーディングでは、モデル単体の賢さだけでなく、エディタ、ターミナル、ファイル編集、テスト実行、レビューの流れまで含めた体験が大事になります。同じモデルでも、どの環境でどう使うかによって成果が変わるんよね。

その意味で、Cursorと組んだコーディング特化モデルという位置づけはかなり分かりやすいです。単に『すごい返答をするAI』ではなく、『開発作業の流れに入るAI』を狙っているわけです。

ベンチマークはすごい。でも現場はもっと汚い

ただし、ベンチマークの数字だけで「もう人間いらない」と言うのは早いです。SWE Bench Proのような指標は参考になりますが、実際の現場では、古いコード、曖昧な仕様、壊れたテスト、謎の命名、誰も覚えていない業務ルールが出てきます。

AIは強くなっている。でも、現場はだいたい汚い。ここを忘れると、総統みたいになります。

総統

総統

余の世界征服システムは、まずログイン画面で余を讃える歌が流れるのだ!
戦闘員

戦闘員

その仕様、消しましょう。
総統

総統

なぜだ!
戦闘員

戦闘員

ユーザーが逃げます。

Grok 4.5の使いどころ

Grok 4.5のようなモデルは、Webアプリのたたき台作成、エラー原因の整理、既存コードの説明、テストケース作成、小さな機能追加にはかなり使いやすそうです。

たとえば、仕様メモから画面構成を作る、既存のエラーを読ませて原因候補を出す、APIレスポンスの扱いを整理する、テストコードを追加する。こういう作業はAIに渡しやすいです。

一方で、本番反映、セキュリティ、権限管理、個人情報、課金処理のようなところは、人間のレビューが必須です。AIに任せる部分と、人間が見る部分を分けられる人ほど強くなる。これはClaude CodeでもCodexでもCursorでも同じやと思います。

AIコーディングにはPC環境も大事

コーディングエージェントを使うなら、ブラウザ、エディタ、ターミナル、ローカル検証を同時に動かす場面が増えます。AIが速くても、手元のPCが重いと確認と修正で詰まりがちです。

AI時代の開発環境は、モデルだけでなく、作業するPC、メモリ、SSD、ブラウザの安定性も含めて考えたいところやね。

アカネ先生のQ&A

アカネ先生のよくある質問

Q1. Grok 4.5は普通のチャットAIと何が違いますか?

アカネ先生

アカネ先生

発表内容を見る限り、雑談用というよりコーディングエージェント向けに寄せたモデルやね。コード修正、テスト、複数ステップの開発作業を回す用途を意識しているのが特徴です。

Q2. ベンチマークが高ければ安心ですか?

アカネ先生

アカネ先生

安心しきるのは早いでぇ。ベンチマークは参考になりますが、現場のコードは古かったり、仕様が曖昧だったりします。最後は実プロジェクトで試して、人間がレビューする必要があります。

Q3. どんな仕事に向いていますか?

アカネ先生

アカネ先生

Webアプリのたたき台、バグ原因の整理、テスト作成、既存コードの説明、小さなリファクタリングに向いていそうです。逆に、セキュリティや課金処理などは人間の確認を外したらあかんところやね。

Q4. AIに全部コードを書かせてもいいですか?

アカネ先生

アカネ先生

下書きや試作ならかなり任せられる場面は増えています。ただし本番投入は別やで。仕様、レビュー、テスト、セキュリティ確認は人間側の仕事として残ります。

まとめ

Grok 4.5は、AIコーディング競争の中でもかなり実務寄りのモデルとして登場しました。Cursorとの共同開発、SWE Bench Proの公表値、速度や価格を見ると、開発現場で長く使われることをかなり意識しているように見えます。

ただし、AIが強くなるほど、人間側の要件定義とレビュー力が問われます。曖昧な命令を投げれば、曖昧な成果物が速く返ってくるだけ。そこは総統も、そろそろ学んでほしいところです。

総統

総統

ではGrok 4.5に、余の代わりに戦闘員へ命令させればよいのだ!
タコゾウ

タコゾウ

試しに『総統の曖昧な命令を、実行可能なタスクに分解してください』って入れてみるっす。

返ってきた答えはこうだった。

「まず、目的・対象ユーザー・必要機能・制約条件・完成基準を明確にしてください」

作戦室が静かになった。

アカネ先生

アカネ先生

AIに論破される上司、最近増えそうやねぇ。
総統

総統

余はAIに負けたのではない! 要件定義という概念に負けたのだ!

それ、だいたい負けてますわ。

参考リンク

関連記事

AIを学んだら、次は働き方や資格も見直してみる
AIツールの使い方を覚えてきたら、その知識を今の仕事だけで眠らせておくのは少しもったいないかもしれません。転職市場でも、AIを使って調査、資料作成、業務改善まで動ける人は評価されやすくなっています。

AIスキルを仕事に活かすなら、転職・キャリア相談も選択肢に。

AIスキルを活かした転職を考える

AI時代を生き抜くなら、資格で基礎を固めるのもあり。

AI時代に役立つ資格学習を考える

Join the Legion

黒焦団のAI活用ログをもっと読む

Work Smartでは、AIツールの新機能、仕事での使い方、失敗しやすい注意点を黒焦団の会話形式で整理しています。

コメント

タイトルとURLをコピーしました