本文へスキップ
開発事例 / Webアプリ

VoiceChat v2 — LLM-Native OS

AI会話をテキストストリームから解放するマルチモーダルOS研究

開発中

VoiceChat v2は「AI会話はテキストストリームに限定される必要はない」という洞察から生まれたマルチモーダルAIチャット研究プロトタイプ。ユーザーが自然な会話を行いながら、同時にキャンバス上でリッチなビジュアル・インタラクティブコンテンツを体験できる。画像が具現化し、地図が探索可能になり、ゲームがプレイ可能になる——すべてが会話の流れの中で起こる。LLM_OS.md / WHITEPAPER.md / TOOLPLUGIN.mdの3部構成ドキュメントで、AIネイティブOSのアーキテクチャとデザインパターンを体系化。OpenAI / Gemini / Anthropic / Ollama / ComfyUIの5モデルを切替可能。

この作品の要点
困っていたこと既存チャットUIはテキストストリームに閉じている。
やったことキャンバスとチャットを統合したマルチモーダルUI。
起きたことマルチモーダルAI OSの研究プロトタイプとして公開。
もくじ

どこでつまずいたか

01既存チャットUIはテキストストリームに閉じている

02ビジュアルと言語理解を自然に共存させるアーキテクチャが未確立

03マルチAIを切り替えながら使う体験が分断されている

どう解いたか

01キャンバスとチャットを統合したマルチモーダルUI

02TypeScriptコントラクト+Vueビューのプラグイン契約を定義

035モデルを統一インターフェースでスイッチ可能に

できあがったもの

できあがった画面

VoiceChat v2 — LLM-Native OS の画面 1
VoiceChat v2 — LLM-Native OS の画面 2
VoiceChat v2 — LLM-Native OS の画面 3
VoiceChat v2 — LLM-Native OS の画面 4

結果

01マルチモーダルAI OSの研究プロトタイプとして公開
02プラグイン拡張の設計パターンを確立

この作品でできること

  • 5つのAIモデルをシームレスに切替(OpenAI/Gemini/Claude/Ollama/ComfyUI)
  • 会話フロー内で画像・地図・ゲームが動的に具現化
  • TypeScriptコントラクトベースのプラグインシステム
  • LLM_OS.md / WHITEPAPER.md の体系化ドキュメント
  • ローカルLLM(Ollama)+ ローカル画像生成(ComfyUI)統合

どう作ったか

できること3項目

5つのAIモデルをシームレスに切替キャンバスとチャットを統合したマルチモーダルUI
会話フロー内で画像・地図・ゲームが動的に具現化TypeScriptコントラクト+Vueビューのプラグイン契約を定義
TypeScriptコントラクトベースのプラグインシステム5モデルを統一インターフェースでスイッチ可能に

つくり2項目

フロントエンド・基盤Vue 3 / TypeScript / OpenAI API / Gemini API / Anthropic API
AI・連携・データOllama / ComfyUI / Google Maps API / EXA API

使いどころ3項目

既存チャットUIはテキストストリームに閉じているキャンバスとチャットを統合したマルチモーダルUI
ビジュアルと言語理解を自然に共存させるアーキテクチャが未TypeScriptコントラクト+Vueビューのプラグイン契約を定義
マルチAIを切り替えながら使う体験が分断されている5モデルを統一インターフェースでスイッチ可能に

担当と道具

担当企画・アーキテクチャ設計・AI連携・プラグイン設計
使った技術Vue 3・TypeScript・OpenAI API・Gemini API・Anthropic API・Ollama・ComfyUI・Google Maps API・EXA API

この作品のきほん

種類Webアプリ
いまの状態開発中
規模担当4領域 / 技術9種類
公開先voicechat.nextcode.ltd

相談する

おなじものが作れます

同じ仕組みを、あなたの商品でも作れます。