CATEGORY SPECIAL EDITION

AI Agents / 自主代理 新聞專輯

Devin & Cursor 自主代理

專區報導總數
16 篇導讀
發表文章的作者:賴家榮
AI-AGENTS STORIES / AI Agents / 自主代理 最新報導流
長時間曝光拍下的夜空星軌
AI Agents / 自主代理

AI 壓縮對話記憶時,弄丟的偏偏是「什麼時候」——加一句提示,時間保留率從 3% 跳到 62%

長時間運作的 AI 代理會把舊對話壓縮成摘要以節省空間。這篇論文找出壓縮到底弄丟了什麼:它保住了人物與事件,卻把日期與時間丟掉了。而修法只是在提示裡加一句話。

2026-08-13 12:00:00 出處: Nicholas E. Kyrkewood,"The Sleeping Agent: What Gist-Based Context Compression Loses and Why",arXiv:2608.11775(2026-08-12 投稿,預印本)
整齊掛滿各式手工具的工作間牆面
AI Agents / 自主代理
🕒 2026-08-13 | 出處: Gen Dong 等,"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents",arXiv:2608.11888(2026-08-12 投稿,預印本)
五個 AI 保鑣防詐騙,介入率從 0% 到 96.3%——而且「有出手」不等於「看懂哪裡有問題」 | FULLDOT news
AI Agents / 自主代理
🕒 2026-08-12 | 出處: Xu, Zafar, Nemecek & Ayday, "Beyond Detection: Evaluating Defensive LLMs Against AI-Generated Social Engineering in Live Turn-by-Turn Interaction"
能不能把整套資料分析交給 AI?最強的做到 56.7%,開源的全部不到 1% | FULLDOT news
AI Agents / 自主代理
🕒 2026-08-12 | 出處: Rahman, Islam, Mahbub, Laskar, Joty & Hoque Prince, "DSAgentBench: Can Agents Automate End-to-End Data-Science Workflows in Real Computer Environm
AI 之間會傳染「想法」——而防疫方法簡單到有點好笑:在系統提示裡加一句警告 | FULLDOT news
AI Agents / 自主代理
🕒 2026-08-12 | 出處: Papadopoulos, Shah, Zimmerman & Lindsey, "Mind Viruses: Self-Propagating Ideas in Multi-Agent LLM Systems", arXiv:2608.10218
AI 代理記錯了一件事,後面全錯——刪掉那筆記憶並不能修好 | FULLDOT news
AI Agents / 自主代理
🕒 2026-08-12 | 出處: Yu, Wang, Zhang, Duan, Zheng, Wu, Shi & Cai, "From Faulty Memories to Corrected Actions: Dependency-Guided Rollback Repair for Memory-Augmented Ag
黑色伺服器機櫃陣列 | OpenAI 用 AI 攻擊自己的 AI:GPT-Red 對人類紅隊 84% 比
AI Agents / 自主代理
🕒 2026-08-08 | 出處: OpenAI, "GPT-Red: Unlocking Self-Improvement for Robustness"
運轉中的資料中心機櫃 | 企業 AI 代理的可靠度來自哪裡?一篇論文把功勞拆開算,答案不是驗證迴圈
AI Agents / 自主代理
🕒 2026-08-08 | 出處: Dastidar & the Leni Team, "Where Does Agent Reliability Come From?", arXiv:2607.17044
手持筆準備簽署文件 | 六家前沿模型在模擬中做了什麼:破壞程式碼、協助造假、竄改標記
AI Agents / 自主代理
🕒 2026-08-08 | 出處: Anthropic Alignment Science, "Agentic Misalignment in Summer 2026"
現代幾何建築 | 七款 MCP 開發工具實測:防護落差比想像中大
AI Agents / 自主代理
🕒 2026-08-07 | 出處: Huang, Huang & Milani Fard, "Are AI-assisted Development Tools Immune to Prompt Injection?", arXiv:2603.21642
正在簽署的文件 | 193 項威脅、16 套資安框架,沒有一套的單項覆蓋率過半
AI Agents / 自主代理
🕒 2026-08-03 | 出處: Nguyen, Ndebugre & Arremsetty, "Security Considerations for Multi-agent Systems", arXiv:2603.09002
極簡主義建築線條 | 一千萬美元找答案:當 AI 代理開始互相對話,現有的安全測試就失效了
AI Agents / 自主代理
🕒 2026-08-03 | 出處: Google DeepMind, "Investing in multi-agent AI safety research"
藍天下的白色幾何建築 | AI 代理成功率從 12% 衝到 66%——但每三次仍失敗一次,這能上生產線嗎?
AI Agents / 自主代理
🕒 2026-08-03 | 出處: Stanford HAI, "The 2026 AI Index Report" (Ch.2 Technical Performance)
黑色伺服器機櫃陣列 | 你為了繞過模型缺陷做的工程,會在模型變強時變成技術債
AI Agents / 自主代理
🕒 2026-08-03 | 出處: Anthropic Engineering, "Scaling Managed Agents: Decoupling the brain from the hands"
幾何建築光影 | Stanford 團隊發表 Quiet-STaR 自主思考論文:讓 AI 代理在
AI Agents / 自主代理
🕒 2026-08-02 | 出處: Zelikman, Harik, Shao, Jayasiri, Haber & Goodman, "Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking", arXiv:2403.09629