The Starting Gun: Navigating the AI Gold Rush (And This Week’s Utter Chaos)

2025-08-11

The Starting Gun: Navigating the AI Gold Rush (And This Week’s Utter Chaos)

Machine-translated from English. Read the English original

やあ、AIの世界へようこそ。故郷では「クレイク(craic)」と呼ぶけど、ここ最近の盛り上がりは本当にすごいよ。もし私のことを知らない人のために自己紹介すると、私は「最先端の技術者」と呼ばれるタイプだ。これはつまり、次なるビッグウェーブに生涯をかけて取り組んできたギークで、コーヒーが冷める前に、自動化やセルフサービスで企業に少しの革新をもたらす方法を探し続けてきた人間のことだ。

私はアイルランド生まれのアイルランド育ちで、約20年前に心とウェールズ人の女性を追いイギリスへ移住した。私のキャリアは、はしごを登るようなものというより、ボルトがいくつか外れたジェットコースターに乗ったような荒々しい旅だった。HPのフィールドサービスエンジニアとして、アイルランド全土をドライブし、屋根にサーフボードを縛り付けてケリー県のサーバーを修理し、出張を最大限に楽しもうとしたことがある。モトローラのスタータック(Motorola StarTAC)の生産ラインを管理したこともあれば(あの最初の折りたたみ携帯電話を覚えているなら、立ち上がったときにため息をつくのに十分な年齢だ)、最近ではHashiCorpでEMEAの顧客成功担当ディレクターを務め、IBMが口を効く前に、そのビジネスを3,000万ドルという小さな規模から3億ドル以上へと成長させるお手伝いをした。私たちはIPO前の紙の上の億万長者から、IPO後の「まあ、ほぼだ!」という立場へ変わった。それは本当に楽しい時間だった。

そのすべてを通じて、私の情熱は、顧客がテクノロジーをどのように革新的で創造的に使用しているかを直接見ることができる現場の役割にあった。私は断続的にブログを書いている。学んだことを共有するためという側面もあるが、主に自分がそれを忘れないようにするためだ。2ヶ月以上使わないと知識が蒸発してしまうと感じる人は私だけだろうか?私のブログは「覚え書き」の宝庫で、何年にもわたるトレーニング、デプロイ、そしてテクノロジーの細部についての楽しい議論から抽出したエッセンスを、完璧なギネスの一杯を注ぐのと同じ愛情を込めて詰め込んでいる。

私はプロフェッショナルであることを誇りに思い、常に顧客に130%の努力を払っている(月曜日は10%、火曜日は50%…というわけだ)。しかし、私の中には少しだけ「愛すべきアイルランドの悪党」もいる。私のグラスはいつも半分満たされており、その楽観的で幸せそうな雰囲気が今週も伝われば嬉しい。なぜなら、OpenStackやパブリッククラウドの革命以来、これほどテクノロジーに興奮したことはなかったからだ。あれこそが、競技場を真に平等にした最後の時だった。今、AIの分野でそれが再び起こっており、大手企業たちはこの野生の獣を制御しようと神経質に試みている。

そもそも「AIエンジニアリング」とは?現場からの私の見解

深入りする前に、「AIエンジニアリング」と私が何を意味しているのかを明確にしておこう。私は機械学習やデータサイエンスについて話しているのではない。ゼロから独自のAIモデルを構築しようとしているわけでもない。早期採用者として、私は3年前からLLMへのアクセス料を自腹で支払っており、多くの企業がそれらをどう扱うべきかさえ知らなかったずっと前からだ。

私の妻は、私が幼児期に戻ったと思っているようだ。モデルが画像を学習して、猫とリンゴの見分け方を知ったと説明しようとした。彼女の返事はこうだった。「リンゴを食べているのか猫を食べているのか知りたいときは、車庫のコンピュータに家族の太陽休暇分の費用をかける代わりに、私に聞いてくれると助かるわよ!」確かにその通りだ。

しかし、進化はついに訪れ、AIはもはや大衆のものとなった。私はエンジニアの視点からそれを見ている。私の仕事は、顧客が新製品をオンボーディングするのを助け、ソリューションが安全で統合され、本番環境で準備ができていることを確認することだ。それは、ものを動かすことだ。90年代にトリニティカレッジ・ダブリンでAIを学んだとき、それは basically 大げさなLISPモジュールだった。私たちはついに、当時夢見ていた場所、おそらくカーク大佐とその話すコンピュータに owe しているビジョンの実現地点にいる。

2025年8月生まれ:カンブリア爆発、洗練されたアップデート、そして不安定なローンチ

このブログシリーズのきっかけは、先週起きた絶対的な嵐のような出来事でした。私たちは新しいAIモデルのカンブリア爆発を目の当たりにしましたが、特に2つのローンチが興味深い物語を語っています。

まず、8月5日、AnthropicはClaude Opus 4.1をリリースしました。これは古典的でプロフェッショナルなテックアップデートでした。これは以前の最高モデルのドロップインリプレースメントであり、コーディング、アジェンティックタスク、推論においてより良いパフォーマンスを提供し、価格は同じです。これは素晴らしい製品をさらに良くする、堅実で漸進的な改善です。GitHubではすでにマルチファイルのコードリファクタリングにおいて顕著な向上が報告されています。クリーンで、シンプル、そして効果的。

その後、わずか数日後、OpenAIはGPT-5をローンチしました。そして、おお、なんと素晴らしい(?)ローンチだったことか。約束されていたのは、新しい統一システムからの「エキスパートレベルの知性」で、あなたのプロンプトを高速モデルか、より難しい問題用の「思考」モデルに賢くルーティングするものでした。しかし現実はどうだったでしょうか? 私の最初の経験は「PhDレベルの専門家」というよりは、「エスプレッソを飲みすぎてしまった困惑したインターン」のようでした。

その結果、彼らが喧伝していたルーターがローンチ日に壊れていたことが判明しました。これはサム・アルトマン氏が後に「sev」(最優先のインシデント)と認めた事実で、モデルが「はるかに賢くない」ように見せることになりました。追い打ちをかけるように、彼らは警告なしに多くのユーザーに対する以前のすべてのモデルへのアクセスを取り消し、私たちを新しい、ふらふらしたシステムに強制しました。これは、 paying customers(有料顧客)を alienate(疎外)する方法の完璧なマスタークラスでした。

さて、今週私たちは完璧な嵐を抱えています:Anthropicからの洗練されたプロフェッショナルなリリースと、OpenAIからの混沌とした、強力だが深く欠陥のあるリリースです。これは、AIエンジニアリングが本当に何についてなのかを探るための完璧な背景です。

モデル名 開発者 主な違い 雰囲気
GPT-5 OpenAI 統一された推論&チャット、「エキスパートレベル」の知性(壊れたルーター付き) 混沌としたローンチ、強力だが欠陥あり
Claude Opus 4.1 Anthropic コーディング&アジェンティックタスクのドロップインアップグレード プロフェッショナル、安定、印象的
Gemini 2.5 Pro Google 高度なマルチモーダル性(テキスト、画像、動画、コード) 静かなるパワーハウス
Llama 4 Meta トップクラスのオープンウェイトモデル、ローカルデプロイを可能にする オープンソースのチャンピオン
Grok 4 xAI Xプラットフォームと統合、リアルタイムデータアクセス ワイルドカード

私のAIジャーニー:今週のロードマップ

今週は、過去数日の狂気によって彩られた、AIエンジニアとしての私の視点を通じた3フェーズのジャーニーをあなたにご案内したいと思っています。

今週は非常に充実した内容になります。なので、コーヒー(またはギネス)を手に取り、この冒険に参加してください。未来はリアルタイムで書かれており、それはスリリングな、少し混沌とした乗り物です。

Originally published on allthingscloud.eu (2025-08-11).

← All posts