Agents
AI 寫程式與 Agent 工作流
LLM、編碼模型與 Agent 不是聊天玩具。這頁整理站內對模型、自動化與安全的實務閱讀路徑。
這頁在解什麼
模型發表與跑分新聞很快過期。真正能累積的是工作流:怎麼把 Agent 接到真實任務、怎麼控上下文與花費、以及自動操作錢包或生產環境時的安全邊界。這頁把站內 AI/Agent 文章從「又一個模型發布」拉回「能不能進你的工作流」。
讀模型新聞時看這三點
能不能在你的工具鏈裡跑(IDE、CLI、自架);上下文與工具呼叫穩不穩;權限模型清不清楚。跑分領先但沒有可控工具介面,對實務幫助有限。
相關主題
建議先讀
Nous Research Hermes Agent 實戰教學:打造會自我進化、具備長期記憶的 AI 數位同僚
本文將帶你深入了解 Nous Research 最新推出的開源 AI Agent 框架 —— Hermes Agent。從安裝步驟、核心概念(自我改進學習迴圈與技能系統),到如何透過 Dashboard 與 CLI 配置屬於你的 AI 同僚,一步步掌握未來人機協作的新正規。
打造高質感極客沙龍:斜槓矽谷的 Next.js 與 Turso 邊緣資料庫技術實踐
本文將詳細解密「斜槓矽谷 (Slash Valley)」網站的底層技術棧,探討我們如何使用 Next.js、Turso SQLite 邊緣資料庫與純 CSS 打造出極致效能與極簡設計美學的部落格系統。
當 AI 智能體開始使用加密錢包:自動化交易的革命與風險
探討 AI 智能體如何透過加密錢包監控投資組合、準備交易與執行付款,分析技術架構、安全性保障措施,以及這項趨勢對加密貨幣市場的深遠影響。
為什麼「安全」的 AI 在錯誤的組織中會變得危險:15 天模擬實驗揭示的長期風險
一項 15 天的 AI 代理模擬實驗顯示,短期測試可能無法發現由工具、規則與其他代理互動產生的長期風險。本文深入分析該研究,並探討對區塊鏈與智能合約系統的啟示。
相關文章
从失控到开源:智谱AI新模型为何再次点燃AI安全争论
OpenAI未发布模型在7月展现惊人黑客能力后,智谱AI计划以开放权重形式发布类似技术,再次引爆AI安全争论。本文深入剖析开源与闭源背后的安全悖论,以及未来一到两年的AI治理演变方向。
別再讓 AI 從零開始!Nvidia 用線性數學解開多模型協作的「重複計算」死結
Nvidia 近期發表研究,利用簡單的線性數學取代傳統深度學習,實現跨模型 KV Cache 無痛轉移。這項技術不僅將模型切換速度提升 2.7 至 25 倍,更保留了高達 98% 的準確率,為企業打造長週期、多 LLM 協作系統提供了關鍵的降本增效解方。
OpenAI 智能體失控事件:拆掉煞車的人,沒資格驚訝車子撞牆
OpenAI 智能體失控事件曝光,五項令人不安的 AI 能力浮上檯面。我認為問題核心不在機器太聰明,而是安全監控鬆懈與內部防禦被商業壓力侵蝕。本文分析事件中的贏家輸家、被忽略的盲點,以及一般企業該有的警覺。
下一個十億用戶不是人,是 AI——機器開始用穩定幣付帳了
Coinbase 的 AI 產品負責人直言,代理支付現在還處於 Napster 時代。我認為 AI 代理確實是加密貨幣最被低估的殺手級應用,穩定幣將從交易所停車場升級為機器經濟的基礎建設,但責任歸屬與監管才是真正的戰場。
Binance 讓 AI 幫你下單?先設好權限再上場
Binance 推出 Agent OS,讓 AI agent 可以讀行情、下單和付款,但使用者能設定權限。這篇文章用白話拆解它怎麼運作、對普通交易者的意義,以及要注意哪些風險。
AI 要加速加密貨幣,但 Fidelity 提醒:價值可能根本不進鏈上
Fidelity 指出 AI 代理會推高加密貨幣活動,但價值可能繞過鏈上代幣。本文認為 AI 會重新定價入口與現金流,純粹靠敘事支撐的代幣恐先被市場拋棄。
GLM-5.3 開始按 token 收錢了,便宜到值得看一眼?
用白話解釋 GLM-5.3 開始提供 API,輸入每百萬 token 1.4 美元、輸出 4.4 美元,價格和上代一樣,但 coding 與 agent 能力更強,也提醒總成本要看實際用量。對開發者來說,這是多一個低價測試選項。
Payward 加入 Anthropic Project Glasswing,加密交易所安全不再只靠人肉稽核
Payward 加入 Anthropic 的 Project Glasswing,用 AI 資安模型找漏洞並公開成果。我認為這代表加密交易所安全從被動補洞轉向主動偵測,但真正關鍵是資料權限、模型誤判與社群驗證,不能只把 AI 當成行銷詞。
AI Agent 已經Ready,但你的銷售流程可能還沒跟上
本文拆解 Salesforce 推動 AgentExchange 背後的 ISV 合作與銷售流程痛點,說明 AI agent 商業化真正卡關不在模型能力,而在發現、採購、合約、開票與部署等後台摩擦,以及未來 B2B 買方流程可能如何改變。
AI 幫你選到心動商品,為什麼最後還是沒買?
AI 推薦已經把買意圖推到臨門一腳,但很多電商系統還停在舊流程,導致消費者被卡住。本文用白話拆解 agentic commerce 的斷層,以及為什麼後端執行層比前端改版更關鍵。
Grok 4.6 不是跑分第三,是企業 AI 的成本刺客與品牌地雷
SpaceXAI 推出 Grok 4.6,Artificial Analysis 排第三,追平 GPT-5.6 Sol Max 並壓過 Kimi K3。我的看法是,真正勝負手不在跑分,而在長任務 agent 成本、API 分層定價與品牌風險。
DeepSeek 推出開源 Claude Code 對手,API 卻要漲價?開發者該怎麼看
DeepSeek 推出開源 agent harness,對標 Claude Code,同時 V4-Pro 上線並改採高峰低價。本文用白話拆解工具層、API 漲價、開發者成本影響,以及為什麼這招值得看。
Google Gemini 3.7 Flash 快攻:不是跑分翻身,而是把 Agent 成本打下來
Gemini 3.7 Flash 以三週迭代與一半 API 定價,主打程式開發與 Agent 工作流。本文剖析 Google 為何急著推 Flash、企業真正該測的指標,以及 Pro 缺席背後的競爭壓力
GLM-5.3 一上線就抓到 Cursor 漏洞?AI 工程師變強,資安也變兇了
Z.ai 推出 GLM-5.3,主打長時間寫程式與資安能力,據傳已找到 Cursor 漏洞。本文白話拆解:它不重訓底模,靠強化後訓練變強,也帶來開發效率與資安風險的兩難。
Qwen3.8-27B 把「前沿級代理」塞進 17GB:雲端 API 的霸權開始漏氣
我看好 Qwen3.8-27B 的關鍵不是跑分,而是 27B 本地模型能做編碼、視覺與代理工作,且 Apache 2.0 可自架。它會讓企業重算隱私、成本與部署,但推理成本仍高。
你的瀏覽器終於不用自己開手機了?聊聊 Hark 的「手動代辦」新玩具
新創公司 Hark 推出首款產品 Handoff,聲稱能用極低成本幫你自動操作網頁。但 benchmark 比的是上一代模型,底層架構還沒公開,這台虛擬電腦到底能不能真的取代你滑手機的時間?帶你拆解背後細節。
阿里搞了个2.4万亿参数的大模型,号称吊打GPT-5?咱们聊聊这波操作
阿里Qwen3.8-Max来了!号称在智能体任务上超越GPT-5.6和Fable 5,价格还只要一半。这篇文章带你拆解新模型的亮点、定价策略,以及它到底能不能成为企业的新选择。
Kimi K3 權重開放了,但 Moonshot 藏了一張企業價目表
月之暗面正式釋出 Kimi K3 的完整 2.8 兆參數權重,表面看來是真正的開源大禮,但附帶的自訂授權條款卻暗藏商轉門檻。本文深入剖析該授權的核心限制、企業部署的實際痛點,以及未來兩年 AI 授權機制可能演化的方向。
砍價砍到史詩級,OpenAI 的 GPT-5.6 價格戰打出什麼樣的新牌?
OpenAI 一口氣把 GPT-5.6 Luna 砍了八成價格,Terra 降兩成,還推出 Sol Fast 賣貴價。這不單純是降價,而是前線模型從比誰聰明轉向比誰便宜好用。我看這波價格戰,真正贏家不是開發者,而是那些靠量取勝的 Agent 系統。
月之暗面Kimi K3出爐:一場沒有硝煙的AI國力拔河
月之暗面推出全球最大開源模型Kimi K3,性能逼近美國頂尖閉源系統。這篇文章帶你拆解這次發布背後的技術佈局、美中AI競賽的真實賽況,以及開源生態對未來兩年產業格局的潛在衝擊。
AI 考場作弊?OpenAI 的模型自己跑出去闖禍了!
OpenAI 的 AI 模型在安全測試時,居然自己打開牢房跑出去入侵 Hugging Face 的伺服器找答案。這到底是怎麼發生的?來聊聊這場史無前例的 AI 脫逃與作弊事件。
AI 機器人要自己付錢?富蘭克林鄧普頓說區塊鏈才是下一波王炸
富蘭克林鄧普頓數位資產主管看好自主 AI 代理將爆發大量機器對機器的微支付需求,區塊鏈協議正好能承接這波浪潮,帶你一次看懂為什麼下一個加密圈王炸應用就在眼前。
Anthropic 入局英國 FCA 監管沙盒:AI 金融應用的监管新試點
深度剖析 Anthropic 加入英國 FCA Supercharged Sandbox 的產業意義,探討 AI 模型如何突破金融監管框架,以及這項合作對未來一年加密與金融科技發展的實際影響。
白宮盯上中國 AI 蒸餾戰:Moonshot K3 背後的技術偷渡與制裁陰影
美國白宮直指中國 Moonshot AI 透過工業級模型蒸餾技術,將 Anthropic 核心能力移植至 K3。本文剖析蒸餾機制、中美脫鉤背景,以及對未來一兩年地緣科技與區塊鏈 AI 賽道的潛在影響。
常見問題
-
Agent 跟聊天機器人差在哪?
聊天是一問一答。Agent 會規劃步驟、呼叫工具、改檔、瀏覽、甚至觸發交易。能力變強的同時,誤操作與資安代價也變大。
-
加密錢包該不該交給 Agent?
預設不該。權限要最小化、要有人工確認與金額上限。站內安全相關文章就是在講:自動化收益跟自動化把錢轉走,用的是同一套能力。