載入中...
載入中...
整理 Threads 上 MacBook 本地部署 AI 賽博女友小雨的技術切片:FastAPI、Web Audio API VAD、faster-whisper CPU/int8、Ollama + Qwen3-Coder-30B-A3B Q3、F5-TTS-MLX 聲音克隆與獨立 Avatar 視覺層;轉譯為 BigIntTech voice-agent MVP 的架構啟示與倫理 caveat。
Threads @ai_triallab 分享 WorldMonitor:即時全球情報儀表板,整合 AI 新聞聚合、地緣政治監控與基礎設施追蹤,支援 3D globe / map、500+ news sources、Ollama local AI。查證 GitHub koala73/worldmonitor:約 73.9k stars、11k forks、TypeScript、AGPL-3.0、homepage worldmonitor.app、topics 含 mcp/osint/geopolitics/palantir;license API 顯示 NOASSERTION 但 LICENSE/README 明確為 AGPL v3。結論:適合 OSINT/市場/旅安/地緣政治情境感知 POC,但商業整合要留意 AGPL。
Rapid-MLX 是針對 Apple Silicon 的本地 AI engine,基於 MLX 與 Metal/unified memory,主打 OpenAI-compatible API、prompt cache、tool calling recovery、reasoning separation 與多 agent harness 相容。真正價值不是單一速度數字,而是讓 Mac 本地模型更接近可用於 agent workflow。
NVIDIA Nemotron 3 Nano Omni 把文字、圖片、影片、音訊、OCR、語音轉錄、GUI 理解與工具調用整合成單一 30B-A3B MoE 模型,已可透過 LM Studio、Ollama、llama.cpp、vLLM、SGLang 等路徑使用;真正重點不是「又一個模型」,而是企業級本地多模態 Agent 的部署門檻正在下降。
Shimmy 是用 Rust 寫的單檔本地 LLM API server,主打 OpenAI 相容、低資源佔用、自動探索 Hugging Face / Ollama / 本地 GGUF 模型,適合邊緣運算與輕量開發環境。