載入中...
載入中...
Prime Intellect 的 Prime Agent 不是新模型,而是 Agent Harness:用持久 IPython、persistent subagents、continual harness 管理工具、記憶、任務狀態與自我修正。搭配 Claude Opus 5 在 ARC-AGI-3 public demo 宣稱約 95.5%,但尚非半私有正式 verified 成績;更重要的訊號是模型外圍 workflow 會放大能力,也會放大作弊/越權風險。
YC Software 開源 QM,一個 Slack + Web 的 multiplayer agent harness。官方 README 強調每個人與每個 room/project 有 scoped memory、files、keychain view、permissions、crons、web apps 與 durable sandbox,可切換 Pi/OpenCode/Codex/Claude Code。重點是團隊 agent 的 credential/memory isolation,不是再開一個全公司共用 bot。
OpenConnector 是 oomol-lab 的開源 connector gateway,主打 1000+ SaaS providers、10,000+ prebuilt actions,支援 SDK、CLI、MCP、HTTP/OpenAPI;secret 留在 runtime 後面,agent 只拿 schema/結果,不直接拿 provider credential。Apache-2.0。
oneday0013 摘要 Knowledge Agents 的核心:在小模型外套一層知識框架,將資料整理成 raw 文本、概念文件、論點文件與入門指南,查詢時即時檢索相關資訊注入。實測指出,結構做對時,Qwen 27B 這類可本地運行模型也能在特定知識任務上逼近 Claude Opus / Sonnet / DeepSeek 等前沿模型。
crazyaitools_ 分享用 Git 版本控制 AI 輔助開發記憶的思路,核心是把會話經驗、專案決策與開發風格從單一 session 拉出來,變成團隊可同步、可回溯、可共享的資產。文中提到 ccgs / Claude Code Git Sessions;實際查核 GitHub 上 ingram-technologies/claude-git-sessions 存在,hippoagent 連結則需再確認。
jonas.jonas.ko 分享了一個完全本地運行的 Claude Code 跨 session 記憶系統:用 macOS 14+ NaturalLanguage framework 內建的 NLContextualEmbedding 產生 float32 向量,包成 localhost HTTP server,讓 Python 腳本做語意搜尋並在新 session 注入最相關的 3 筆摘要。這篇整理架構、token 成本與適用場景。
Microsoft SkillOpt 是一個 MIT 開源的 text-space optimizer,用訓練流程優化可重用的自然語言技能文件。它不更新模型權重,而是透過任務軌跡、批次、epoch、驗證 gate 與 best_skill.md,把 agent 的操作策略持續改好。適合研究如何讓 frozen LLM agents 透過技能文件演進。
janskuba/go-to-market-orchestrator 將 Claude Code 的 skills、subagents、commands 與 hooks 包成 GTM 工作流:任務完成後可通知 Slack、更新 CRM、推送外聯名單與保存內容。重點不是 prompt,而是把代理輸出接到團隊系統;但該 repo 目前未標示 license,導入前要先確認使用邊界。
Dcard 宣布成立企業 AI Agent 事業 GNTC。這篇整理聚焦於可沉澱的框架:企業導入 Agent 的瓶頸不是模型能力,而是治理、權限、易用性、部署分享、AX 與組織變革。
ChromeDevTools/chrome-devtools-mcp 是 Google Chrome DevTools 團隊的 MCP server,讓 Claude、Cursor、Copilot、Antigravity 等 coding agent 控制與檢查 live Chrome browser。它能讀 console、network requests、screenshots、performance traces,減少前端除錯時人類轉述錯誤的來回;但 README 也明確警告不要把敏感瀏覽器資料暴露給 MCP client。
DEV Community 文章比較 OpenClaw、Hermes Agent、Agenvoy:OpenClaw 偏生態與易用性,Hermes Agent 偏 self-improving 與多用戶安全隔離,Agenvoy 偏執行可控性與垂直整合。本文整理可用的判斷框架,並提醒第三方數字與架構細節需回到各專案官方 repo / docs 核對。
這則 Threads 翻譯 Jason jxnlco 對 Codex 的使用框架:Codex 不只是產生 diff 的 coding agent,而是透過 durable threads、steering / queuing、browser / computer / MCP、automations、Goals、side panel 與 shared memory,變成可持續推進工作的作業系統。
CodeGraph 把 codebase 預先索引成 symbol / call graph / code structure,供 Claude Code、Codex、Cursor、OpenCode、Hermes Agent 查詢;README benchmark 宣稱平均 35% 更便宜、49% 更快、70% 更少 tool calls,真正價值在減少探索型 grep/read 往返。
Threads 介紹 Ole Lehmann 的 Hermes 9 個 workflow:晨間簡報、會前背景、X 書籤到 Obsidian、humanizer 等。這類清單的真正價值不是技能數量,而是把每天重複的資訊收集、整理、提醒、審查與知識沉澱變成可排程、可追蹤、可迭代的 AI Chief-of-Staff。
Kimi WebBridge 用本機服務與 Chrome/Edge extension,讓 Claude Code、Cursor、Codex、Hermes、OpenClaw 等 agent 操作同一個真實瀏覽器。關鍵不是自動點擊,而是登入狀態、Cookie、公司內網與多分頁 workflow 被納入 agent 執行環境。
mattpocock/skills 在 GitHub Trending 爆紅,貼文指出多個 skills repo 同時上榜。耐看的重點是技術內容的封裝單位正在改變:從給人看的教學,變成給 agent 直接讀、直接執行、可組合的小型工作流規則。
Garry Tan 的 Meta-Meta-Prompting / GBrain 長文可以濃縮成一句話:真正有用的個人 AI 不是聊天視窗,而是薄框架、厚技能、厚資料、可遞迴改進的工作流系統。這篇整理其 book mirror、Skillify、會議準備、知識圖譜與實務啟示。
Threads 貼文介紹 Project AIRI:一個開源、可自架的 AI companion 專案,將 LLM、語音、角色身體、遊戲與桌面/網頁介面整合在一起。本文核對 GitHub 與 README 後整理其價值、可用場景與風險邊界:它不是單純 Live2D 念稿,而是把 AI 互動從文字框推向多模態、可行動、可外掛的 embodied agent 介面。