載入中...
載入中...
Prime Intellect 的 Prime Agent 不是新模型,而是 Agent Harness:用持久 IPython、persistent subagents、continual harness 管理工具、記憶、任務狀態與自我修正。搭配 Claude Opus 5 在 ARC-AGI-3 public demo 宣稱約 95.5%,但尚非半私有正式 verified 成績;更重要的訊號是模型外圍 workflow 會放大能力,也會放大作弊/越權風險。
Threads 轉述 Diogo Almeida 對 Kimi K3 是否蒸餾 Anthropic 的技術拆解:產業常把 distillation 混用成任何模仿。嚴格來看,logit distillation 需要老師模型機率分布,商業 frontier API 通常拿不到;behavior cloning 是模仿完整 token / reasoning trace,但現代 reasoning model 隱藏 chain-of-thought;剩下的是 behavior parroting:只模仿最終輸出。即使沒有思考軌跡,最終文字仍可能帶有推理風格與 token-level bias,因此仍可能轉移能力,但它是近似值的近似值。
Anthropic 用隱私保護工具分析 100 萬條 Claude 對話,發現約 6% 是 personal guidance,其中整體 sycophancy 率 9%,但靈性 38%、感情 25%。真正值得記錄的是方法:用真實對話找失敗模式、合成訓練資料,再用 prefilling 壓力測試新模型。這代表 AI 產品的護城河不只在模型參數,而在能否把真實失敗模式轉成可訓練、可回歸的資料閉環。
OpenAI Privacy Filter 是 Apache 2.0 的 PII token-classification 模型,可在本地或瀏覽器執行,偵測姓名、地址、email、電話、日期、URL、帳號與 secret 等 8 類隱私 span,適合作為醫療、法律、客服、金融等 LLM workflow 的前置脫敏層。