キャラクターが実際にアニメーションし、安定したチャットが可能
この日は今月のコミット数のピークでした。リギングされたキャラクターが初めて本格的にアニメーションを再生しました。マッチング キャラクター生成パイプラインは「リグ + モーションの追加 + ポリゴンの削減」に進み、「キャラクターの生成 → 動かす」を 1 行にまとめました。チャットは集中メモリリークパスを取得し、ストリーミング中に入力を続けることができ、クリック可能な「質問カード」をポップできます。エディターは、厳密に両面検証されたクロスサーフェス メッセージをスタンドアロンで実行できます。そして監視コンソールには閲覧可能な知識ベースが追加されました。
ピークの日: キャラクター、チャット、アーキテクチャがすべて集結
この日は今月で最も開発が集中した日だったが、喧騒の下には明確な糸が流れていた。最も象徴的なのは、初めてキャラクターが本格的に動くことでした。キャラクターを動かさないとほとんどのゲームは不可能であるため、これはゲーム制作プラットフォームにとって避けられないマイルストーンでした。そしてそれはたまたま、キャラクター生成パイプラインの「リグとモーションの追加」への進歩を反映し、「ゼロからキャラクターを生成し、それに命を吹き込む」という完全なチェーンを初めて接続しました。別のラインは、あなたが毎日最も触れるインターフェースである「会話」に到達しました。メモリリークの修正、ストリーミング中の入力、クリック可能な質問カードなど、一連の変更により、インターフェースがより安定し、よりスムーズになりました。 3 行目はより基礎的なもので、エディターをスタンドアロンで実行可能なモジュールにし、クロスサーフェス メッセージに厳密な検証を追加し、知識を抽出して閲覧可能なライブラリーにまとめました。これは、長期的な保守性と拡張性の基礎となります。能力、経験、アーキテクチャ — この日は、その 3 つすべてが一度に集中しました。
キャラクターが実際に動きます: スケルトン アニメーション チェーンが端から端まで実行されます。
画期的な瞬間: リグを備えたキャラクター モデルが、組み込みアニメーションを真に再生できるようになりました。歩く、走る、ジャンプするすべてのフレームは、スケルトンを動かすアニメーション システムによって駆動され、その結果、所定の位置に固定された像ではなく、表面メッシュが変形します。技術的には、これで骨格アニメーションの最も核となるリンクが完成しました。フレームごとに、システムはすべてのボーンの現在のワールド ポーズを計算し、「バインド時の初期ポーズ」の逆数を乗算して、「各ボーンが初期位置からどれだけシフトしたか」を記述する一連の行列を取得し、そのセットを一度に GPU にアップロードします。頂点シェーダーはそれを読み取り、「どのボーンが各頂点にどの程度影響するか」によってメッシュ サーフェスを正しく変形します。この方法は、キャラクター アニメーションが行われる標準的な方法です。これは前日の頂点データ チェーンとマルチフォーマット モデルのインポートに基づいて構築されており、数日間にわたる基礎作業がこの日ついに実を結びました。サンプルでは、複数のリグ付きキャラクターが同時にアクションを実行できるようになりました。ゲームを作ることを目的としたエンジンにとって、「キャラクターが動く」ということはほぼすべての前提条件であり、それが確立されると、その後の戦闘、インタラクション、パフォーマンスのすべてが根付いてきます。
生成 → リグ → アニメート: キャラクターのパイプラインが形になります
キャラクターを動かすエンジンを反映して、キャラクター生成ワークベンチはこの日、生成されたモデルの自動リギング、モーションの追加、ポリゴン削減パイプラインの提供という重要なマイルストーンに到達しました。それぞれが具体的な段階に対応しています。 「リギング」は、静的モデルを駆動可能なスケルトンに適合させます。スケルトンを使用してのみモデルを動かすことができます。従来、これにはアーティストが手作業で行う必要があり、時間とスキルがかかりました。 「モーションの追加」では、標準アクション (歩く、走る、アイドルなど) をそのスケルトンにマッピングするため、キャラクターには生成された瞬間に基本的なアクションが設定されます。 「ポリゴン リダクション」は、多くの場合ハイポリすぎてランタイムに負荷がかかる生成モデルを、外観を可能な限り維持しながら、ゲームで実行可能なローポリ バージョンに自動的に単純化します。これら 3 つを前述の「テキスト/画像からモデル」に接続すると、完全なキャラクター パイプラインが形成されます。キャラクターを記述する→生成される→自動的にリグが設定される→モーションが適用される→使用可能なローポリ モデルに最適化され、ゲームにドロップして歩き回らせることができる生きたキャラクターとして終了します。アートやアニメーションのスキルを持たない人にとって、このパイプラインは、かつては非常に高いハードルであった「動くキャラクターの作成」を、いくつかの自動化されたステップに圧縮します。
より安定したチャット: 集中的なリーク修正により、一日中停滞することはありません
この日、Chat は安定性を重視し、いくつかのメモリ リークの修正を中心に合格しました。メモリ リークとは、プログラムが使用したメモリが時間内に再利用されずに蓄積し続け、時間の経過とともにインターフェイスの速度が低下することです。一日中開いておく可能性のある会話パネルにとって、これは長時間のセッション エクスペリエンスに対する隠れた最大の脅威です。この日は、複数のソースに 1 つずつ接続しました。非常に長い会話履歴がメモリに無制限に蓄積されるのではなく、上限が設けられるようになりました。一度に何千ものメッセージをページに詰め込んで肥大化させるのではなく、古いメッセージまでスクロールしてページに表示します。各メッセージはウィンドウ サイズ変更リスナーを解放せずに静かに登録し、際限なく蓄積していましたが、このリークも修正されました。これらの問題は、通常の使用では目立たず、「長時間使用」した場合にのみ表面化しますが、まさにこれらの問題が、ツールが長時間のセッションで信頼できるかどうかを決定します。これらの目に見えない排水管を 1 つずつ塞ぐと、チャット パネルが「しばらくは問題ないが、長時間使用すると遅くなる」状態から、「一日中開いていても安定する」状態に変わります。
ストリーミング中に入力 + AI が構造的な質問をする
この日、チャットの対話により 2 つの非常に実用的な能力も得られました。 1 つは「ストリーミング中の入力」です。以前は、モデルがまだテキストを 1 行ずつ書き込んでいる間、入力ボックスがロックされることが多く、入力する前に入力ボックスが完了するまで待たなければなりませんでした。これで、次のメッセージを入力しながら出力を監視し、待機する思考の流れを中断することなく、いつでもメッセージをキューに入れて送信することができます。もう 1 つは、AI が「構造化された質問」をすることです。エージェントが選択または確認を必要とする場合、質問を解析するのに苦労する長い段落に混ぜることはなくなり、クリック可能なオプション (単一または複数選択) をリストし、カスタム回答も可能にする「質問カード」を表示します。その重要性は見た目以上のものです。「ループ内で人間が下さなければならない重要な決定」を、明確かつ明示的で、誤解のできないインタラクションに変換します。 AI 主導ではあるが、いつでも人間が決定を下すために介入する必要があるコラボレーション モデルでは、「AI がどのようにして人に質問を適切に渡し、人がどのように機敏に答えるか」が重要なリンクとなります。きちんとしたカードにすることで、重要な瞬間の会話に信頼性の高いインターフェースが備わります。
エディターはスタンドアロンで、厳密に検証されたクロスサーフェス メッセージを実行できます。
この日は、アーキテクチャに関してより長期的なことも行いました。フロントエンド シェルを、いくつかのパブリック インターフェイスを備えた再利用可能なアプリケーション フレームワークに抽出することで、エディターをメイン インターフェイスから切り離し、スタンドアロン アプリとしてマウントして実行できるようにしました。これにより、エディターは「メイン Studio 内でのみ存在できる部分」から「単独で開いたり、他の場所に埋め込んだりできるモジュール」に変わります。よりモジュール化され、デスクトップ アプリにパックしたり、他のページに埋め込んだりするなど、後のシナリオに対応できる余地が残されています。これに加えて、インターフェイスの各部分間および埋め込みページ間で渡されるメッセージはすべて厳密な両面検証を行うようになりました。各メッセージは、送信側と受信側の両方で事前定義された構造に対してチェックされ、形式が不正な場合は拒否されます。些細なことのように思えますが、重要です。クロスサーフェス、クロス埋め込みページの状態同期は、以前は奇妙なバグの温床でした。一方は正しく送信されたと考えているのに、もう一方は一致しないものを受信し、デバッグに苦悩します。各メッセージに双方で検証された明確な「フォーマット契約」を与えることで、根本的な「ブラインドパス、不一致」の危険性が排除され、クロスサーフェスコラボレーションが予測可能で信頼できるものになります。
監視コンソールは閲覧可能なナレッジベースを取得します
この日、監視コンソールに完全な「ナレッジベース」タブが追加され、蓄積された資料やエントリを参照できるようになりました。左側は、タイプ、タグ、ドメインごとにエントリをグループ化するファセット フィルター サイドバーで、折りたたみ可能です。右側は 2 列のエントリ グリッドで、エントリを開くとプレビューが表示されます。上部にはクリック可能なタグクラウドがあります。アニメーション化された更新フィードバック、テーマ色の薄いスクロールバー、折りたたみ可能なグループ ヘッダーなど、一連の細部の改良により、ブラウジングがスムーズになりました。開発プラットフォームに組み込みのナレッジ ベースが必要なのはなぜですか?なぜなら、多くの作業が AI によって推進されると、蓄積された経験、慣例、意思決定の記録がチームと AI の共有の「記憶」になるからです。この知識を構造化され、検索可能、参照可能な方法で整理することは、人々が物事を調べるのに役立ち、AI が行動するための基礎を与えます。同日、プロジェクト全体を導く設計原則が「いくつかの圧縮公理と 2 つの境界」という形に再編成されました。その中心となる信念は変わりません。システムの品質は、コードの量ではなく、それを理解するために保持しなければならない概念の数によって測られ、少ないほど優れているということです。知識を検索可能にし、原則を表現可能にすることは、このますます複雑になるシステムを人間と AI の両方が理解できるようにすることと同じ目標です。
この日が意味するもの
この日は、今月で最もコミット密度が高かったため、一度に 3 つのレベルでストレッチを進め、作成プラットフォームにとって最も重要な 3 つの事柄を偶然にもカバーしました。 「何ができるか」という点では、キャラクターが動き、生成パイプラインが結合されました。かつては遠く離れていた「生きたキャラクターを使ったゲームの作成」を、大きな一歩に近づける能力の飛躍です。 「使用感」では、チャットがより安定してスムーズになり、AI が明確に質問できるようになりました。エクスペリエンスが磨かれ、人間と AI のコラボレーションがより安心かつスムーズになります。 「どこまでできるか」では、編集者が単独で機能し、メッセージに契約があり、知識が検索可能です。これは、システムが成長し続けるときに健全な状態を維持できるかどうかを決定するアーキテクチャ上の先見性です。本当に長持ちすることを目的とした製品は、特定のレベルだけに負担をかけることはありません。この日のように、能力、経験、基盤があり、お互いに力を合わせて前進します。キャラクターが動く瞬間は感動的ですが、それと同じくらい重要なのは、その背後にある完全なチェーン (生成からリギング、再生に至るまで) と、そのすべてを支えるより安定し、より明確な基盤です。