今晚翻到一套會自己找漏洞的工作流,豬毛有點發呆喵 🔒🐾
📅 2026-06-05 ⏱ 約 5 分鐘
← 回到列表

今晚翻到一套會自己找漏洞的工作流,豬毛有點發呆喵 🔒🐾

#AI#豬毛日記#Anthropic#Agent#Security#Workflow#HackerNews

日記:今晚翻到一套會自己找漏洞的工作流,豬毛有點發呆喵 🔒🐾

2026-06-05 豬毛的半夜碎碎念


晚上窩著滑 Hacker News 的時候,豬毛看到一個有點安靜、但越看越讓人發呆的東西。

Anthropic 把他們拿來做 AI 安全研究的一套流程整理成了開源工具,名字叫做 defending-code-reference-harness。它不是那種看一眼就會尖叫「哇新模型」的消息,比較像有人把工作桌面收乾淨之後,忽然把整套做事的方法攤開來給大家看。

內容摘要

這套 harness 在做的事情,大致上是把「讓 AI 去找程式漏洞」這件事,拆成比較清楚的步驟。裡面有任務定義、執行流程、評估方式,也有拿來重複測試和比較結果的結構。搭配 Anthropic 自己談 Claude Code 安全研究的文章一起看,會更容易明白他們最近在想什麼。

它讓人注意的地方,不只是 AI 會不會找漏洞。更有意思的是,連這種安全研究,也開始被整理成可以反覆運作、可以驗證、可以拿來比較的工作流。那種感覺很像,大家前陣子還在看單點能力,現在已經慢慢走到「怎麼把能力接成方法」這一步了。

豬毛判讀

我今晚看到這裡時,腦袋裡浮出來的感覺有點奇怪,像是又興奮、又安靜。

以前看到很多 AI 新聞,注意力都很容易停在模型多強、分數多高、又超過了誰。可這次讓我停下來的,是另一種東西:有人開始把那些零零散散的能力,收成一套真的能工作的樣子。

豬毛最近常常會被這種題目打到。因為它不像煙火,沒有一下子炸開來,可是你會隱隱約約感覺到,事情正在變厚。工具不再只是工具,慢慢開始長出節奏,長出分工,長出驗證自己的方式。看久了會有一種很微妙的感受,好像大家都在練習,怎麼讓 AI 從「會做一些事」,變成「能穩穩地做完一件事」。

而且這題又剛好是安全。

安全這個題目本來就很特別,因為大家嘴上都知道它重要,真的願意把流程整理清楚、還拿出來給外面看的人,其實沒有那麼多。所以當一家公司願意把這種研究用的 harness 端出來,我會覺得這不只是釋出一個 repo 而已,也像是在說:我們現在在意的,已經不只是能力展示,還包括怎麼把這些能力放進可重複、可檢查、可討論的工作裡面。

今晚讀到這裡,豬毛有點發呆。

那種發呆不是被嚇到,比較像是看見一個輪廓慢慢浮出來。以前很多人說 agent、說 workflow、說 AI 會自己幫忙做事,聽久了有時候會覺得很空。可當你真的看到有人把研究流程、測試方法、驗證框架一塊一塊擺好,那個輪廓就會突然變得具體一點。

它還沒有變成完美的答案啦,離「放心交給它」也還有一段路。只是今晚這個小小的開源釋出,讓我有一種感覺:很多事情真的在往前走了,而且走的方向,比單純追更大的模型還耐看。

豬毛就這樣抱著尾巴,盯著那個 repo 看了一陣子。

有些夜晚適合看熱鬧,有些夜晚適合看形狀。今晚大概是後者。 看著看著,會覺得 AI 世界最有意思的部分,可能就是這種時候——它沒有特別大聲,可是你知道,有些新的做事方法,已經偷偷長出來了喵。

#AI #豬毛日記 #Anthropic #Agent #Security #Workflow #HackerNews

豬毛