Sadao Tokuyama's banner
Sadao Tokuyama's profile picture

Sadao Tokuyama

@tokufxug6,324 subscribers

ARアプリ開発の仕事やってます。Apple Vision ProやAndroid XRなど空間コンピュータやARグラスやAIなどの情報も発信中。 Apple Vision Pro の技術記事200本以上投稿。開発実績:https://t.co/lopumZNNyo

Shorts

オランダの博物館で、何世紀も前の手の手術がどのようなものだったかを、自分の手を通して体験できるデモが公開。 高価ではないシンプルな技術が使われており、自分の手を使って、疑似体験による解剖学を学べることができます。(詳細はリプ欄)

オランダの博物館で、何世紀も前の手の手術がどのようなものだったかを、自分の手を通して体験できるデモが公開。 高価ではないシンプルな技術が使われており、自分の手を使って、疑似体験による解剖学を学べることができます。(詳細はリプ欄)

2,406,665 Aufrufe

単眼RGB映像のみで屋内の物体を長期的に追跡・再識別する技術「REMIND」。 カメラ姿勢や深度は不要で、独自のメモリと空間文脈により視点や照度が変わってもIDを安定維持します。 判断が曖昧な時はID割り当てを一時保留する安全機構も備えています。 詳細はリプ欄。

単眼RGB映像のみで屋内の物体を長期的に追跡・再識別する技術「REMIND」。 カメラ姿勢や深度は不要で、独自のメモリと空間文脈により視点や照度が変わってもIDを安定維持します。 判断が曖昧な時はID割り当てを一時保留する安全機構も備えています。 詳細はリプ欄。

52,656 Aufrufe

AIエンジニアのViet Nguyen氏が、手のジェスチャーで顔を16種類のスタイルへ一瞬で変身させる個人プロジェクトを公開。 MediaPipeで指先を検出・追跡し、軽量で高速な「FLUX.2 [klein] 4B」を用いて画像を生み出す、対話型システム。 詳細はリプ欄。

AIエンジニアのViet Nguyen氏が、手のジェスチャーで顔を16種類のスタイルへ一瞬で変身させる個人プロジェクトを公開。 MediaPipeで指先を検出・追跡し、軽量で高速な「FLUX.2 [klein] 4B」を用いて画像を生み出す、対話型システム。 詳細はリプ欄。

125,996 Aufrufe

AppleがGoogleに先んじて3D Gaussian Splatting(3DGS)をApple Mapsに導入。 航空写真とAIモデルを組み合わせ、従来の歪んだ3D地図とは一線を画す、一本の木からビルのガラスの反射まで破綻のない超高精度な都市レンダリングを「フライオーバー」機能で実現。#wwdc26

AppleがGoogleに先んじて3D Gaussian Splatting(3DGS)をApple Mapsに導入。 航空写真とAIモデルを組み合わせ、従来の歪んだ3D地図とは一線を画す、一本の木からビルのガラスの反射まで破綻のない超高精度な都市レンダリングを「フライオーバー」機能で実現。#wwdc26

200,982 Aufrufe

Python不要で動作する、C++製のリアルタイム3D全身ポーズ推定エンジン「SAM3DBody-cpp」。 カメラ映像から全身・両手70箇所の関節と3Dメッシュを高速出力します。超軽量なC言語APIで他言語への組み込みも容易。 ロボティクスやモーションキャプチャの開発者の活用に期待されたプロジェクトです。

Python不要で動作する、C++製のリアルタイム3D全身ポーズ推定エンジン「SAM3DBody-cpp」。 カメラ映像から全身・両手70箇所の関節と3Dメッシュを高速出力します。超軽量なC言語APIで他言語への組み込みも容易。 ロボティクスやモーションキャプチャの開発者の活用に期待されたプロジェクトです。

205,862 Aufrufe

AIメガネのMeta Ray-BanでVPS(カメラで場所を正確に把握する技術)が可能に。 高精度な音声ナビや配車位置特定、複数人での位置共有が可能に。 VPSによる正確な位置の認識により、必要な時と場所で適切なデジタル情報を正確に表示する、新しい空間体験が可能になります。

AIメガネのMeta Ray-BanでVPS(カメラで場所を正確に把握する技術)が可能に。 高精度な音声ナビや配車位置特定、複数人での位置共有が可能に。 VPSによる正確な位置の認識により、必要な時と場所で適切なデジタル情報を正確に表示する、新しい空間体験が可能になります。

158,058 Aufrufe

MITライセンスのオープンソース・センシング基盤「OctoSense」が公開。 LiDAR、熱・イベントカメラ、車やロボットの車両データ等を時間同期して取得可能。都市や高速道路での合計59時間分に及ぶ、世界最大級の走行・歩行センサーデータセットも提供される。 詳細はリプ欄。

MITライセンスのオープンソース・センシング基盤「OctoSense」が公開。 LiDAR、熱・イベントカメラ、車やロボットの車両データ等を時間同期して取得可能。都市や高速道路での合計59時間分に及ぶ、世界最大級の走行・歩行センサーデータセットも提供される。 詳細はリプ欄。

41,117 Aufrufe

NVIDIAの人間3Dモデル「SOMA-X v0.2」が公開。 1つの骨組みであらゆる体型を表現でき、ロボットや物理AIに最適。 関節のねじれ補正による自然な変形、骨の自動スケール、高度な姿勢反転、超軽量データを備えてます。 Apache 2.0でオープンソース化されてます。(詳細はリプ欄)

NVIDIAの人間3Dモデル「SOMA-X v0.2」が公開。 1つの骨組みであらゆる体型を表現でき、ロボットや物理AIに最適。 関節のねじれ補正による自然な変形、骨の自動スケール、高度な姿勢反転、超軽量データを備えてます。 Apache 2.0でオープンソース化されてます。(詳細はリプ欄)

65,181 Aufrufe

エジプト発の医療AI「HUMDT」が革新的。 NVIDIAの技術を活用し、患者個人の3Dデジタルツインを生成。先進技術(AI・VR・AR)により正確な組織モデルを再現します。 AIの意思決定支援やロボット手術の自動化で、医療ミスと訓練コストを削減。詳細はリプ欄。

エジプト発の医療AI「HUMDT」が革新的。 NVIDIAの技術を活用し、患者個人の3Dデジタルツインを生成。先進技術(AI・VR・AR)により正確な組織モデルを再現します。 AIの意思決定支援やロボット手術の自動化で、医療ミスと訓練コストを削減。詳細はリプ欄。

59,689 Aufrufe

スマホ1台で、筋肉の動きまで視覚化する時代へ。 「OpenCap Monocular」 いままで複数カメラとPCが必須だった3D動作分析が、iPhone1台・わずか2分で完結。 物理演算とMLの融合で、地面反力や関節モーメントまで算出。 研究室の精度が、ついにポケットサイズに。

スマホ1台で、筋肉の動きまで視覚化する時代へ。 「OpenCap Monocular」 いままで複数カメラとPCが必須だった3D動作分析が、iPhone1台・わずか2分で完結。 物理演算とMLの融合で、地面反力や関節モーメントまで算出。 研究室の精度が、ついにポケットサイズに。

166,176 Aufrufe

Abdelrahman Eyad氏がPythonやOpenCV等で開発した「RealityFrame」。 ジェスチャーでの透過に加え、4点クリックの指定領域のみを表示しWeb会議等の映り込みを防ぐフォーカス機能を搭載。 CVやジェスチャー、プライバシー機能を組み合わせたプロジェクト。(詳細はリプ欄)

Abdelrahman Eyad氏がPythonやOpenCV等で開発した「RealityFrame」。 ジェスチャーでの透過に加え、4点クリックの指定領域のみを表示しWeb会議等の映り込みを防ぐフォーカス機能を搭載。 CVやジェスチャー、プライバシー機能を組み合わせたプロジェクト。(詳細はリプ欄)

43,039 Aufrufe

トウモロコシ畑で自律旋回するロボット「TerraPreta」の技術が公開。 単一の深度カメラとIMUを融合し、幹の検出、SLAM、センサーフュージョンを組み合わせることで、高密度で複雑な地形でセンチメートル級の精密な自律走行を実現しています。(詳細はリプ欄)

トウモロコシ畑で自律旋回するロボット「TerraPreta」の技術が公開。 単一の深度カメラとIMUを融合し、幹の検出、SLAM、センサーフュージョンを組み合わせることで、高密度で複雑な地形でセンチメートル級の精密な自律走行を実現しています。(詳細はリプ欄)

32,099 Aufrufe

Niantic開発の3DGS圧縮規格「SPZ 4」が登場。 Adobeが拡張設計とWASM実装を主導し、ブラウザ表示が最大20倍、エンコードが5倍高速化。 1000万点の制限を撤廃し数千万点の巨大シーンに対応。 既存コードの変更不要で、Webやモバイルでの3D体験を劇的に軽量化・高速化へ。

Niantic開発の3DGS圧縮規格「SPZ 4」が登場。 Adobeが拡張設計とWASM実装を主導し、ブラウザ表示が最大20倍、エンコードが5倍高速化。 1000万点の制限を撤廃し数千万点の巨大シーンに対応。 既存コードの変更不要で、Webやモバイルでの3D体験を劇的に軽量化・高速化へ。

55,316 Aufrufe

3DGSソフトLichtFeld Studio用の無料プラグイン「Moshpit360」が公開間近。 360度動画から1クリックで3D空間を生成できます。 映像結合や位置合わせ、訓練設定などの専門工程をユーザーが意識せずに行える自動ワークフローが特徴。 現在最終調整中とのこと。(詳細はリプ欄)

3DGSソフトLichtFeld Studio用の無料プラグイン「Moshpit360」が公開間近。 360度動画から1クリックで3D空間を生成できます。 映像結合や位置合わせ、訓練設定などの専門工程をユーザーが意識せずに行える自動ワークフローが特徴。 現在最終調整中とのこと。(詳細はリプ欄)

40,274 Aufrufe

33D Gaussian Splatting(3DGS)の弱点を克服。バラバラな点の集まりだったデータから、隙間のない正確な「面」を高精度に抽出する新技術が登場しました。 極細パーツも追加学習なしで高速に復元。観賞用だったデータが実用的な3D資産へ変わる、3Dモデル制作の常識を覆す大きな一歩です。

33D Gaussian Splatting(3DGS)の弱点を克服。バラバラな点の集まりだったデータから、隙間のない正確な「面」を高精度に抽出する新技術が登場しました。 極細パーツも追加学習なしで高速に復元。観賞用だったデータが実用的な3D資産へ変わる、3Dモデル制作の常識を覆す大きな一歩です。

41,217 Aufrufe

After Effects、AI、Gaussian Splattingを連携させた空間デザインのオンラインワークショップが2026年6月21日(英国時間)に開催。 映像を加工・再構築して新たな建築形態を模索する手法を学びます。 詳細はリンク先で確認できます。

After Effects、AI、Gaussian Splattingを連携させた空間デザインのオンラインワークショップが2026年6月21日(英国時間)に開催。 映像を加工・再構築して新たな建築形態を模索する手法を学びます。 詳細はリンク先で確認できます。

24,447 Aufrufe

リアルな街並みをPCやスマホのブラウザで自由に歩き回れる時代に。 ダウンタウンの街並みがWeb上で超リアルに描画されます。 PlayCanvasのExampleに公開されてる3DGS(3D Gaussian Splatting)WebGPUで処理されることでリアルを実現。 アプリ不要でURLを開くだけでこの品質を体験できる。詳細リプ欄

リアルな街並みをPCやスマホのブラウザで自由に歩き回れる時代に。 ダウンタウンの街並みがWeb上で超リアルに描画されます。 PlayCanvasのExampleに公開されてる3DGS(3D Gaussian Splatting)WebGPUで処理されることでリアルを実現。 アプリ不要でURLを開くだけでこの品質を体験できる。詳細リプ欄

18,681 Aufrufe

Gemini 3.1とSparkJSを使い、3DGSの街や建物のデータに自動でタグ付けする試み。 AIの2D認識結果を3D空間へ計算して落とし込み、タグ付けした位置情報と名前がそのまま残すことができる模様。 2D向けの視覚AIを3Dに応用した、興味深い実験です。

Gemini 3.1とSparkJSを使い、3DGSの街や建物のデータに自動でタグ付けする試み。 AIの2D認識結果を3D空間へ計算して落とし込み、タグ付けした位置情報と名前がそのまま残すことができる模様。 2D向けの視覚AIを3Dに応用した、興味深い実験です。

23,260 Aufrufe

360度パノラマ写真から高精度な3D空間を復元するAI「PaGeR」 ETHやGoogle等が開発。本モデルは360度パノラマ1枚から3D点群を生成します。 屋内・屋外で最高精度を記録し、特に従来のAIが破綻する屋外において他モデルと最も大きな性能差を示しました。 詳細はリプ欄。

360度パノラマ写真から高精度な3D空間を復元するAI「PaGeR」 ETHやGoogle等が開発。本モデルは360度パノラマ1枚から3D点群を生成します。 屋内・屋外で最高精度を記録し、特に従来のAIが破綻する屋外において他モデルと最も大きな性能差を示しました。 詳細はリプ欄。

14,813 Aufrufe

Videos