有料プラン(3カ月分)を無料プレゼント中!詳しく見る
App IconMemolith
2026年09月25日 19:25

Grok 4.7発表、法務や電気工学に強い新モデル

執筆: Takumi(Memolith開発者)
メモリスメモリスによる要約
  • SpaceXAIが新モデル「Grok 4.7」を発表、法務や電気工学向けの性能を強化
  • 法務・電気工学の実務を測るベンチマークで前モデルGrok 4.6や他社モデルを上回った
  • 価格は前モデルと同水準に据え置き、入力は100万トークンあたり2ドルから

SpaceXAIは2026年9月21日、新モデル「Grok 4.7」を発表した。同社はこのモデルを、コーディングと知識労働向けに自社が持つ最も高性能なモデルと位置づけている。

強化の重点は専門職向けの実務能力にある。法律事務の実務タスクをAIに解かせて正答率を測るベンチマーク「Harvey Legal Agent Benchmark」で19.6%を記録し、前モデルGrok 4.6の15.8%、他社モデルGPT-5.6 Solの2.5%、Fable 5.1の6.7%をいずれも上回った。電気工学の専門知識を問うベンチマーク「EEBench」でも64.0%となり、Grok 4.6の53.0%、GPT-5.6 Solの39.4%を上回っている。価格面では前モデルと同じ水準を維持したまま性能を引き上げた形で、入力は100万トークンあたり2ドル、出力は100万トークンあたり6ドルからとしている。同社はコーディング向けベンチマーク「CursorBench 4.0」でも46.3%を記録し、長時間かかるコーディング作業において価格性能比でフロンティアに位置すると説明している。モデルは発表と同日から、開発ツール「Cursor」やGrok API、サードパーティのコーディング環境などを通じて利用できる。

Harvey Legal Agent Benchmark。Grok 4.7: 19.6%、Grok 4.6: 15.8%、Fable 5.1: 6.7%、GPT-5.6 Sol: 2.5%。数値はいずれも同社発表のベンチマーク結果

法務や電気工学は、これまで生成AIが「参考程度」の扱いを受けやすかった領域だった。契約書レビューや回路設計の妥当性チェックは、間違いが実害に直結するため、専門家がAIの出力を鵜呑みにできない場面が多い。ベンチマークのスコアが専門職向けタスクで上がってきたということは、こうした領域でもAIをレビュー前提のドラフト作成者として使う場面が広がっていくことを示している。

法務や電気工学のような専門領域の判断をAIに任せる場合でも、ベンチマークのスコアだけを根拠に導入を決めるべきではない。ベンチマークは公開された課題セットでの成績であり、自社が扱う契約書の書式や社内の設計基準といった個別の文脈までは反映していない。実務に組み込む前に、自分たちの実際の案件データで出力を検証する工程を挟むべきだろう。

もう一つ、価格を前モデルと同水準に据え置きながら性能を引き上げたという打ち出し方にも注目したい。値下げ競争ではなく「同じ価格でより賢く」という訴求は、モデル間の性能差が縮まりコストが導入判断の主要な変数になりつつある市場で、価格据え置きそのものが差別化の材料になっていることを示している。専門職向けツールを選ぶ際は、単価の安さよりも、自社の業務でどれだけ手戻りを減らせるかで比較する方が実質的な判断になる。

法務や電気工学のような高度な判断はAIに任せる領域が広がる一方で、打ち合わせの記録や議事の整理のような定型業務は、それとは別の切り分けで自動化できる。録音した音声を後からAIが文字起こし・要約するAIボイスメモの「メモリス」に任せてしまえば、専門特化型のAIとのやり取りに割ける時間が増える。

参照: Introducing Grok 4.7

メモリス ブログの記事を、Googleで便利に検索できます

Googleで優先ソースとして追加
有料プラン(2,490円相当)を
無料プレゼント中!
詳しく見る