載入中...
載入中...
Threads @liq_media 介紹 FreeMoCap:用多支普通 webcam / camera 做無標記點動作捕捉,把人體動作轉成 3D skeleton / motion data,可接 Blender。本文查證 GitHub、PyPI、官方網站與 release notes:FreeMoCap repo 約 9.7k stars、AGPL-3.0、PyPI 1.8.2、v2.0.0-alpha.17 仍標示 alpha / rough edges。適合研究、教育、動畫原型與作品集;若要包進商業產品、SaaS 或客戶交付,必須先處理 AGPL copyleft 與服務開源義務。
黃子齊 Threads 記錄 OpenAI Build Week Community 黑客松:四人團隊三小時用 Codex 做出 MoveLog 智慧運動紀錄 demo,並提到父子檔用網頁打造 3D 無人機模擬飛行訓練。重點是 Codex 在短 sprint 中把想法推到可展示產品,而不是完整商用品質。
Ant Group/Robbyant 開源 LingBot-Map:以普通相機影片做 streaming 3D reconstruction,README 稱約 20 FPS、518×378、單 GPU、可跑超過 10,000 frames;核心是 Geometric Context Transformer,透過 anchor context、pose-reference window、trajectory memory 統一座標錨定、局部幾何與長距離漂移修正。GitHub 實查約 11.8K stars、Apache-2.0,模型放 Hugging Face,但落地機器人導航仍需驗證延遲、尺度、鏡面/動態干擾與精度掉落。
Threads 提到 roboflow/supervision GitHub stars 突破 45k、近三週快速成長。實際查證後,repo 目前約 46.9k stars、MIT license、PyPI 最新版 0.29.1。supervision 不是 YOLO 的替代模型,而是把 detection/segmentation/classification 結果轉成可用工作流的 Python 工具包:annotation、dataset format、metrics、tracking、video/zone counting、model connector。
整理 NVIDIA LocateAnything 與 Parallel Box Decoding:它不是單純下一代 YOLO,而是把視覺語言定位中的 bounding box / point 當成原子單位平行預測,改善 VLM grounding 的速度與幾何一致性。
微軟 TRELLIS.2 是 4B 參數 image-to-3D 模型,核心是 O-Voxel:同時承載幾何與 PBR 材質,改善複雜拓撲與可接工作流問題。貼文的「3 秒生成」需加上 H100、512³ 等條件;本地部署也需要 Linux 與至少 24GB NVIDIA GPU。