載入中...
載入中...
CabLate 的貼文提醒:面對更強模型,不要把 prompt / skill 寫成窮舉 rules;更穩的做法是陳述原則、目標與判斷框架。規則能控制少數情境,但任務變化、資訊不足或突發狀況時,模型容易變成一個口令一個動作。
ego-lite 是 citrolabs 開源的 AI agent browser,目標是讓 Codex / Claude Code 等 agent 使用你的真實登入、cookies、extensions 與 bookmarks,但在自己的 Spaces 執行瀏覽器任務,不干擾人類 tabs。GitHub 查證 MIT、約 4.9k stars、macOS-first。
Threads 介紹美團 CatPaw:手機可派任務看進度,桌面可讀檔、操作瀏覽器、跑終端機,雲端模式可延續任務,並把本地生活經驗包成專家與技能。公開查證有限,本文重點記錄其產品形狀:垂直場景 know-how + agent 工作台 + 可交付文件/報告/程式碼。
AI郵報轉述 Sam Altman 用手機 prompt 讓 ChatGPT 規劃 9 人週末旅行並生成全端網站。公開可查證來源有限,因此本文把它視為產品方向訊號:AI 從回答問題走向為一次性任務生成臨時工具,競爭焦點從「能不能做」轉向「能不能穩定重現」。
Block Buzz 是 self-hostable agent workspace,不只是 Slack clone。它用 signed event log / Nostr relay 思路,把人、agent、repo、workflow、review approval 放在同一套可稽核空間;Apache-2.0,但仍屬高速變動早期專案。
Cloudflare 開源 agentic-inbox:完全跑在 Cloudflare Workers 上的自托管郵件客戶端,收信用 Email Routing,每個 mailbox 用 Durable Object + SQLite,附件放 R2,AI agent 可讀信、搜尋對話並草擬回覆。本文整理架構、部署 caveat 與 BigIntTech 適用邊界。
Threads 作者實測 codebase-memory-mcp 與 graphify:graphify 帳面 token 省更多,但在字串/prompt 類問題上漏答;codebase-memory-mcp 因有全文檢索搭配 graph,6 題全對。本文查核 GitHub metadata 並整理導入評估框架。
ihower 分享 LlamaIndex Beyond RAG workshop 導讀,核心論點是 RAG 錯誤多半不是最後生成模型問題,而是文件解析、表格/圖表結構、chunk 粒度、reranking、agentic loop 與 structured query routing 的工程問題。本文整理對 Allen KB / Hermes RAG 架構的實務含義。
Threads 介紹 openings-mcp v0.10.1:個人開源求職 MCP server,可從 Claude Code、Codex、Gemini CLI 等 MCP client 搜尋 104、Cake、LinkedIn、Indeed、マイナビ転職、Jobindex,以及 Workday/Ashby/Greenhouse/Lever 等 ATS 與 Amazon/Apple/Google/Meta/NVIDIA/TSMC 等職涯站;MIT License,但 README 強調非官方、需低頻使用且不做大量 scraping。
Threads 作者整理 5-Day AI Agent 課程第三堂:重點不是堆 multi-agent swarms 或超大 context,而是用 Agent Skills 把任務流程、scripts、references 封裝成可版本化、可測試、可治理的工程資產。
Threads 提到 Coasty(YC S26)推出 computer-use agent API。實查 YC 公司頁與官方網站:Coasty 定位為可在既有軟體、桌面工具與 legacy 系統中執行工作並自我修正的 computer-use agent。官方網站宣稱 85.60% OSWorld,YC 頁面文字則寫 82%,需注意指標版本差異。
Raymondhou0917/speak-human-tw 是繁體中文、台灣用語導向的去 AI 味改寫 skill。實查 GitHub metadata:MIT License,約 554 stars,支援 Claude Code / Codex / Cursor / OpenCode 等以 Markdown skill 方式使用。
Threads 介紹 tmux-bridge-mcp:一個把 tmux pane 包成 MCP 工具的跨 Agent 終端協作層。實查 GitHub repo 與 npm package;repo metadata 目前未偵測到 GitHub LICENSE,但 npm package 標示 MIT,導入前仍應以倉庫授權狀態為準。
Threads 作者提出 Hermes MACES:一個安裝在 Hermes plugin 系統下的「潛意識層」,被動吸收工具/對話使用痕跡,形成帶權重的概念與關聯,只以統計型 advisory influence 影響推理;實查 GitHub repo 很新、Python、1 star、尚無 LICENSE,適合 sandbox 研究,不宜直接視為成熟可商用套件。
OpenKnowledge 是 inkeep 開源的 local-first Markdown 編輯器與 LLM Wiki,主打 WYSIWYG Markdown、Claude/Codex/Cursor 協作 AI 編輯、MCP/CLI 整合、agentic search、skills 與 Git/GitHub 驅動的團隊分享與自動同步。Threads 作者將它定位為 Obsidian / Notion 替代品,重點是筆記不只被儲存,而是能被 agent 直接查詢。專案授權為 GPL-3.0-or-later,適合評估作為 AI agent 第二大腦與規格驅動開發知識庫。
Threads 討論從「Claude 很積極但容易把特殊邏輯越解越複雜」出發,dustin_gmat 推薦 danyuchn/first-principles-skill。這個 Claude Code skill 把第一性原理拆成 6 階段,特別加入 Phase 0 Delete First:在分析怎麼做之前,先問需求本身是否該存在。它適合架構評審、需求瘦身、避免 cargo-cult best practice,以及把 AI 生成的一堆方案重新壓回本質。
Anthropic 將 Claude Skills 以資料夾形式開源示範,讓 Claude 在特定任務上動態載入指令、腳本與資源。17 個官方 Skill 分成文件處理、設計品牌、工程開發、溝通內容與 skill-creator;實務上不該全部安裝,而是先挑 5–8 個高頻場景避免觸發競爭。
Threads 作者以 LINE 智慧客服 + 預約系統 POC 為例,說明為何會偏向使用 Flue:LINE Bot 本質是 webhook、驗證、訊息解析、agent/workflow、工具呼叫與回覆的事件流程;Flue 的 agents、workflows、channels、tools、sandboxes 與可部署 TypeScript harness,適合把 AI agent 放在多通道、流程型、可部署的 POC 裡。文章以瑜伽教室預約為例,拆出 YogaBookingAgent、booking tools、database、booking engine、RAG 與人工客服的責任邊界。
TaiLexi 宣布可透過 MCP 在 Claude、ChatGPT 等 AI 平台使用台灣法律資料庫。重點不只是資料接入,而是讓 Opus 4.8 類模型能反覆查詢、驗證、改關鍵字、沿新爭點深挖,形成接近真人律師研究流程的 agentic loop,但代價是 token 消耗極高。
Portless 將 localhost:3000/3001 這類易變 port 轉成 https://myapp.localhost 等穩定本機網址,並透過 v0.15 的 portless doctor 提供唯讀環境診斷,適合多個 AI coding agent、worktree 與多專案並行開發場景。
JeffreysPrompts.com 是 agentic coding prompt collection,其中 Idea Wizard 的 30-5 方法要求 AI 先產生 30 個想法,再批判篩選成最佳 5 個並落地執行。真正價值不是收藏更多 prompts,而是把高 leverage prompt 變成固定工作流。
Claw-Eval-Live 用 105 個市場訊號導向的 workflow tasks 評估 13 個 frontier models,第一名也只過 66.7%。真正重點不是分數,而是 benchmark 的 evidence contract:用 traces、audit logs、service state 與 artifacts 驗證 agent 是否真的完成工作。