金磊 発信元 凹非寺
量子位 | 公式アカウント QbitAI
TRAE、先ほど大きな動きをした。
以前のあなたは、バグを修正するにはTraeCodeを開かなければならず、技術的な方案を提出する場合は、「閃身歩」を使ってTraeWorkに移動しなければなりませんでした……

今は、そんな面倒なことは必要ありません。
それらの機能は今日、正式に双端融合され、新しいTRAEに統一されてアップグレードされました。

新しいTRAEの特徴は、AgentモードとIDEモードの2種類があることです。
その中で、エージェントモードはグローバルワークステーションを中心にしています。皆さんは一つのウィンドウ内でプロジェクトを管理し、異なる作業を複数のエージェントに割り当てることができます。コードの書き込み、ドキュメントの作成、提出資料の準備などがここで進められます。

IDEモードでは、SOLOとIDEの2つのプレイ方法が残っています。2つのモードを切り替える入口は右上角にあり、クリックするだけで移動できます。

例えば、先頃全体的なAI業界を大騒ぎにした3D版ペリカンが自転車をこぐのように、新しいTRAEの「起動方法」はこのようなものかもしれません。
同じプロジェクトフォルダ内で3つのタスクを新規作成し、3つのエージェントがそれぞれの役割を果たします。
- エージェント1:コードを書き、ペリカン、自転車、そしてシーンを作成しなさい;
- エージェント2:テストを行い、ページのスクリーンショットを開いて確認し、問題リストを作成する;
- エージェント3:提供されたリストに従って、問題が存在する項目を一つ一つ修正する。

最終的に、まるで小さなチームのように連携して作業し、完全に機能する3D版ペリカンの自転車を完成させました。
すると、このペリカンは新しいTRAEで、開発、テスト、修正、納品という一連のプロセスを完全に無事に終えた。
また、この期間に生成されたテストレポート、修正レポート、納入説明などは、自動的に新しいTRAEの「私の成果」に保存されます。各成果は直接他人と共有できます。

明らかで、一見してわかる。
では、AI Coding分野の経験豊富なプレイヤーであるTRAEは、なぜ突然これら二つの端を統合したのでしょうか?
初心者とプロの開発者にとって、新しいTRAEはまた何が違うのか?
これらの問題を抱えながら、深層実験を通じて感じてみるのも良いでしょう。
小白も一つのアイデアからゲームを作ることができる
新しいTRAEが、プログラミングができない初心者でも、自分のアイデアをゲームに変えることができるかどうかを見てみましょう。
たまたまMinecraftの創始者Notchは以前、AIコーディングが悪いと言っていましたが、後に自分はそれを楽しんでおり、自分の地下城ゲームの地図エディターを作っていると投稿しました。
ですから、最初の実験では、自分で地下牢を作り、中に入って歩ける3D地下牢ゲーム用のマップエディタを作ることにしました。
今回は、新しいTRAEでプロジェクトを完成した後、同時に2つのタスクを開始しました。1つはゲームプランニングの作成を担当し、もう1つはインターフェースデザインの原稿を担当します:

見ての通り、指示を出した後、2つのエージェントがすぐにそれぞれの仕事に取りかかりました。
あまり時間が経たないうちに、二つの成果が提出されました。
企画エージェントが提出したのは、Word形式の企画案と、内容が同じなMarkdownファイルです。操作手順、各要素の利用方法、検収基準がすべてはっきりと記載されています。
デザインエージェントは実際に高精細なデザイン原稿を描き出しました。編集モードと第一人称試遊モードの2つのインターフェースが一つの図面にまとめられており、全体としては低多面体の地下牢スタイルを採用しています:

次に、3つ目のタスクを新しく作成し、企画とデザインの成果を読み込んで、コードを書き始めるようにします。
しかし、このステップで非常に実際的な小さな出来事が起こりました。企画と設計が同時に行われていたため、2つのエージェントはお互いの成果を見ることができず、それぞれが自分のものを書いてしまったのです。
例えば、デザイン図のグリッドは20×20ですが、企画案では32×32になっています。消去ツールのキーコマンドは、一つがEに、もう一つがXになってしまいました。怪物の更新ポイントでさえ、一つは全図に1個だけ置くと言い、もう一つは3個置くと言っています。
開発を担当するエージェントが二つのファイルを読んだ後、『まず遊べる簡易版を作る』という原則に従って、これらの衝突点を一つ一つ選び去り、その理由も納品説明に記載しました:

これはまた、エージェントが多くなると、単に役割を分担するだけでは不十分であり、全体を統括する役割が必要になることを示しています。
コードを書き終えた後、開発エージェントは自らブラウザを開いてテストを行い、6つの問題を修正しました。例えば、試用モードに入ると「一時停止」のウィンドウが表示されることや、試用画面が暗すぎて廊下さえ見えないことなどです。
最終的に作られたエディタでは、床、壁、ドア、宝箱、引き棒、モンスターのリフレッシュポイントを簡単に配置でき、元に戻す・やり直す機能、自動保存、JSONのインポート・エクスポートもすべて備わっている:

動画アドレス:
https://mp.weixin.qq.com/s/tckIeqpzcq2jB11STQLTBg
注目すべきは、Notchが作っている新しいゲームの名前が「Levers and Chests」ということで、直訳すると「引き棒と宝箱」です。
エディタの中のこれら二つは、彼への少しの敬意として[solute]と見なします。
同じように、このプロジェクトが終了した後、Wordの企画案、デザイン原稿、デザイン説明、テスト提出説明などが、すべて「私の成果」の中に整然と収まっています。
これは以前に戻す必要がある。以前の成果物は、チャット記録の中に埋もれたり、各フォルダに散らばっている。今では一つのページを開けば見つかる。次に修正したい時は、いつでも戻ってページを開けばいい。
では、特別な詳細内容を変更したい場合はどうすればいいですか?
一鍵でIDEモードに切り替える方法をご覧ください。
右上隅でIDEモードに切り替えた後、直接ダイアログボックスに入力します:
第一人称の歩行速度を70%に調整する。
数分後、走行速度を1秒間に3.4マイルから2.4マイルに下げ、走行速度も同時に下がった。
簡単に言うと、通常はエージェントモードでAIに複雑な開発を任せることができます。詳細に注目する必要がある時には、IDEで一行ずつ見直すこともあります。二つのモードにはそれぞれの利用方法があります。
本当の仕事でも役立つ
ゲームを作るのは楽しいですが、プロの開発者にとっては、新しいTRAEが日常の仕事に耐えられるかどうかがより重要かもしれません。
では、次の実測では、プログラマーたちがよく困る作業である〈古いプロジェクトを引き継ぐこと〉に直接焦点を当てます。
そのために、TeamDeskというシミュレーションプロジェクトを準備しました。これは小規模なタスク管理ウェブページで、約20のファイルがあります。データはすべて架空のもので、プロジェクトには問題リストも含まれています。
今回は、プロジェクト内で一気に3つのタスクを新設し、3つのエージェントが同時に作業を開始しました。
- エージェント1:コードを読み、プロジェクトを理解し、新人向けのアーキテクチャ説明書を作成する。
- エージェント2:バグ修正のみを担当し、テストファイルには触ってはならない;
- エージェント3:復帰テストの補完のみを担当し、ビジネスコードには手を出してはならない。
エージェント1が提供したアーキテクチャ説明は、ウェブページのレポートであり、このプロジェクトがどのような層に分かれているか、ページ上の操作がデータにどのように影響を与えるか、そしてデータが最終的にブラウザのどの場所に存在するかをわかりやすく説明しています。
Bugを修正するAgent 2は、まず問題リストに従って再現し、原因を見つけた後、一行のコードのみを変更し、統計にアーカイブされたタスクを除外する条件を追加した:
最後に、エージェント3が回帰テストを補完した後、最終結果が表示されました:
その後、再び元のコードを確認したところ、3つのエージェントがそれぞれの役割を忠実に果たしており、ビジネスコードは1行だけ変更され、テストフォルダには新しいファイルが1つ追加されただけだった。
このような回帰テストは、実際には日常で新しいTRAEの自動化機能に任せることもできます。例えば、毎朝自動的に一度実行させて、問題が見つかったらあなたに通知するようなものです。興味がある方は自分で試してみてください:
もう一つ、より日常生活に近いシナリオを見てみましょう。一人が完全なイテレーションを渡す。
今回、私たちが自分自身に課したタスクは、FeedbackDeskという名前のフィードバック処理台を作ることで、内部レビュー会でデモを行うことです。レビューに必要なものには、製品要件文書1部、操作可能なウェブページデモ1つ、そしてレビューペイント1部が含まれます。
同じように、私たちは一気に3つのタスクを新規作成しました:
- エージェント1:製品要件文書を作成する;
- エージェント2:ウェブページデモを行う;
- エージェント3:出評審PPT。
間一瞬も経たないうちに、3人のエージェントがそれぞれの成果を提出した。それは、4ページのWord要件文書1件、ブラウザで直接操作できるウェブページ1件、そして6ページの評価PPTと付随する講演原稿1件であった。
以前は要件文書を作成したり、PPTを作ったりするとTraeWorkに行き、ウェブページを作るとTraeCodeに戻るという状態でした。今では同じウィンドウの中で、一団のAgentがこれらすべてを同時に進めています。
さらに便利なことに、新しいTRAEにはテンプレートライブラリも提供されているため、このような文書作業の場合、テンプレートを使えば直接作業を始められます。
もっと便利な方法があります。
TRAEにいなくても、今度はフェイスブックや微信を連携させていただければ、@TRAEと直接通知するだけでクロスプラットフォームでの動作が可能になります。またスマホ端末でも同期されるんですよ:
便利で、本当に便利だ。
なぜ二つを合わせるのか?
最後に、最初の問題に戻ります。AI Coding分野の経験豊富なプレイヤーとして、TRAEはなぜ二つの端を一つに統合するのでしょうか?
数回の実験を行った結果、私たちが最も感じたのは、コードを書くことは実際には開発の一環に過ぎないということでした。
一つのプロジェクトがアイデアから実装に至るまでには、前段階でニーズを分析し、計画書を作成し、デザインを行う必要があります。後段ではテストを行い、バグを修正し、報告を行う必要があります。
以前、これらの段階は二つのツールに分かれており、文脈も二か所で途切れ、成果も二か所に散らばっていた。人は中間で挟まれて、回りくどい歩きをしなければならなかった。
そして、新しいTRAEが今回行ったことは、このリンクをつなぎ合わせて、全リンク開発プラットフォームに変えることです。
縦軸で見ると、要件の分解から提供まで、文書、デザイン、コード、テストをすべて同じプロジェクト内に置くことができ、反復的なプロセスは自動化によって処理され、デスクトップ、ウェブページ、スマホの三つの端末でも同期が保たれます。
横から見ると、ワークステーションがすべてのプロジェクトを管理しており、複数のエージェントが並行して進めることができます。どのタスクがどのステップで止まっているかは、左側のバーで一目で確認できます。本当にコードを大幅に修正する必要がある時は、もう一度一押しでIDEに戻ればよいです。
海外を見渡すと、この事業はTRAEだけが行っているわけではない。
今年の4月、CursorはCursor 3を発表しました。これにはエージェントを専門に管理するAgents Windowが追加され、古典的なIDEインターフェースも保持されています。両方のインターフェースをいつでも切り替えることができます。Claude CodeにもAgent Viewが導入され、1つのパネル内で複数のバックグラウンドエージェントを同時に起動、管理、監視することが可能になりました。
見ての通り、海外のトップクラスのAIプログラミングツールは、「エージェントの管理」と「コードの修正」を同じツールに統合している。
しかし実際のテストでわかったのは、エージェントが多いと、事態が自動的に良くなるわけではないということです。例えば最初のペリカンについて言えば、開発を担当するエージェントは自信満々で、ブラウザで2回テストしたので問題はないと言っていました。しかしテストを担当するエージェントが手を付ければ、4つの問題が見つかり、方向キーも逆になり、右クリックするとペリカンが左に突進してしまいます。
さらに、地下牢のエディター内でそれぞれが別々の役割を果たす企画とデザイン、そしてフィードバック処理台での数値が完全に一致する3つの成果物があり、その規則性は実際には明らかになっている。
結局のところ、人が行うべきことが変わった。今では、私たちはより多くの時間を、作業を明確に分けること、エージェントに共通の根拠を用意すること、そして誰が作業をし、誰が検査するかを決定することに費やしている。
これもまた、新しいTRAEのこのアップグレードが解決したい問題かもしれません。
結局のところ、TRAEはAI Codingの分野で既に熟練したプレイヤーです。今回、2つのツールを一つに統合したのは、ワークステーションを利用して開発の各段階を全て担い、より多くの創造的な開発者にサービスを提供したいからです。
エージェントにコードを書かせることから、一連のアイデアを実行し成果物を提供するまでを指揮することまで、AI Codingは正式にエージェント開発の新たな段階に入ったと言える。
その往復で切り替わる「閃身歩」は、今後は使えなくなるだろう。