
kk@study
@kk_design_dev • 2,380 subscribers
Orangestar / ホロライブ / やってみた系はハイライトに / アイコンは@uniuni738 さん
Shorts
Videos

実際のところゲームどうなんだろうとOpus4.8への指示でやってみた ClaudeCode経由で実装、音声、画像、発話、モデリング全部やってくれる FableでなくOpusだけで充分ありがてぇ! 楽曲・効果音生成でOSSはずーっとイマイチな印象だったけど楽曲生成でのAceStep1.5、効果音生成でのStableAudio3がめっちゃ良くなってた ●ゲームエンジン : Rust Bevy Engine ●ComfyUI 楽曲 : Ace Step1.5 効果音 : StableAudio3 画像、テクスチャ等 : Qwen Image 実況音声 : Vertex Gemini TTS → Irodori-TTS ●3Dモデル ・BlenderMCP→Sketchfab ・ComfyUI Qwen & Trellis2 → BlenderMCP ・ComfyUI Qwen & Hunyun3D → BlenderMCP
kk@study161,839 просмотров • 1 месяц назад

神威 + Three.jsでエルデンリーング! 楽しかったw Elden Ring with Kamui! It was fun! #kamuiart ●開発 Cursor + Windsurf + Claude 3.7 ●画像関連 空と背景: 神威(t2i) 地面: 神威(t2i) 草: 神威(t2i) 岩: 神威(t2i & i23D) ドラゴン: 神威(t2i) + TripoAI(3D) + Blender(Rig + Animation) 騎士: 神威(t2i) + TripoAI(3D + Rig) + Blender (Rig + Animation) ●音源 楽曲: SunoAI 効果音: 神威(StableAudio) + 素材サイト ●参考 エルデンリングやったことなかったので兎田ぺこらの配信で全て学んだ…!
kk@study181,406 просмотров • 1 год назад

Unity AR 口頭依頼でMastraAgentが判別してClaude Code ActionでThreejsゲーム実装 ! ベースはDreamCore + 神威で開発! #kamuiart #kamuidev 要望をぽんぽん投げると、github常駐の無数のClaudeAI達が各々非同期で作ってくれて最後報告書とともに連絡くれる感じです 微調整をCursorでやると良さそう ちなみに口頭で伝えるより圧倒的にターミナルから文字列でやった方がスムーズです やってみたかっただけ... 1 DreamCoreでFPS Gameのベース生成してダウンロード(Zoltraakパターン) 2 神威で画像、GLB 3Dモデル、音源生成 (騎士はMixiamo) 3 Cursor調整 + Claude Code Actionの設定 4 Unity > MastraAgent > Git Cli + Claude Code Actionで並列実装開始 神威とDreamCore相性いい☺️ FPS 3D Base: DreamCore 怪物: 神威 t2i23D (imagen4 + Rodin)+ Blender Animation 騎士: GPT4o + Tripo 3D + 自動Rig 背景: 神威 t2i (imagen4) 効果音: 神威(Stable Audio) 楽曲: Riffusion Unity: にじボイス VroidHub
kk@study43,702 просмотров • 1 год назад

#kamuicode のメディアギャラリーアプリをビジョンモデルのqwen2-vl-7b-instructで解析して、画像の内容で検索できるようにカスタマイズしてみた✨ 街並み、女性などイメージで探せるのとローカルLLMで完結するのでフリーでいくらでもいける 解析(HTML > JS > py > API LMStudio)で caption/tags を生成 ├→ MySQL (メタデータ保存) ├→ Meilisearch (全文検索 / フィルタ) └→ Qdrantでベクトル化 してセマンティック検索 添付は画像解析して 全文検索、セマンティック検索それぞれで検索しているところ ベクトル化は日本語が得意というPreferred NetworksのPLaMo-Embedding-1Bを使ってみた AIが一般化されるまではPFNの製品に触れることなどまずないだろうと思っていたので感慨深い... 最初Ollamaでやったらいまいち安定せず、LMStudioにしたらサクサク行けた Meilisearchはめっちゃ速くて相性が良き
kk@study33,932 просмотров • 11 месяцев назад

日本語リアルタイム通話LLMのMoshiをクラウドGPUのRunPodでやってみた! 内容はカオスでしたが、めっちゃ感情表現豊かで楽しそうに話すので楽しかったw 会話の内容が本家と違いすぎてポテチの発音が良くなかったのだろうか... 1. Runpodでubuntu借りる GPU RTXA4500 → Ubunth → Edit TemplateボタンクリックでContainerサイズを30Gなど大きくする → Deploy on Demand で決定 (model.safetensorsだけで15G以上あるので デフォルトの5Gサイズだとエラーになる) 2. ローカルPCでssh-keygenして管理画面から公開鍵登録して接続 3. cd /home/ubuntu/ 4. apt update; apt install python3-pip -y; apt install python3.12-venv; 5. python3 -m venv venv; source venv/bin/activate; 6 pip install moshi 7 UI起動 python -m moshi.server --hf-repo nu-dialogue/j-moshi-ext --host 0.0.0.0 --port 8888 8. connectボタン > HTTP Serviceがreadyになったらクリックで表示
kk@study42,477 просмотров • 1 год назад

神威 + Unityでお散歩ARアプリと広告作ってみた!3Dモデルと会話しながらお散歩 #kamuiart #kamuidev おでかけARという既存アプリを参考にAI(GPT4o)と対話、風景の画像解析して説明してくれるのをつけたやつ モデルはVroidhubで公式配布されているものをお借りしました🙏 今後APIにもメモリー機能ついてid付与ができたら個人最適化されたアシスタントがどのアプリにも組み込めるようになるのかな 動画は広告風にしてみたw にじボイスめっちゃナイス! ●ARアプリ 開発: Unity AR Foundation 3Dモデル: Vroidhub(公式配布) アニメーション: Mixiamo 声: 神威 にじボイス & API にじボイス 効果音: 神威 ElevenLabs ロゴ: 4o + Photoshop ●動画 動画: 神威 Vidu + Vidu & HailuoAI Browser 画像: ComfyUI > 神威 > Figma 声: 神威 にじボイス 曲: Riffusion 編集: Davinci 20
kk@study16,110 просмотров • 1 год назад
Больше нет контента для загрузки