## 📋 X 動態摘要(過去 24 小時)
最後更新:台北時間 2026-08-04 21:20
### 💰 「100 億美元的算力合約,對象是一家成立幾個月的新創」
Bloomberg(@business)報導某實驗室與一家成立才幾個月的基礎設施新創簽下一筆一百億美元的算力合約,這是該公司為了跟上需求所做的最新努力;把一百億美元交給一家幾個月的公司,這件事本身就說明了算力市場的緊張程度。 (2084614099019735243)
The Kobeissi Letter(@KobeissiLetter)快訊指出某國財政部長說與某國的協議最快可能明天宣布,並聲稱該協議會重新開放某海峽;「最快明天」這個時程在反覆多次之後仍應保留。 (2084608853056885137)
Watcher.Guru(@WatcherGuru)以稍微不同的措辭報導同一件事:該部長說最快明天可能達成協議、以重新開放那個海峽;兩個來源的措辭差異值得對照。 (2084612894550069344)
Watcher.Guru(@WatcherGuru)另報導某交易所執行長說某國「需要」那項加密法案,並引述「經濟安全就是國家安全」;把產業訴求包裝成國安論述是常見的遊說策略。 (2084620338059792622)
Serenity(@aleabitoreddit)指出一個對西方供應鏈非常實質的催化劑出現了,從幾家具名的光通訊公司一路到另外兩家,因為某政府正在草擬對新的某國某某的禁令;把政策消息對應到具體受益公司是很實際的分析。 (2084597612175618342)
阿毛(@LmhdbAi)觀察某電商公司真有點東西:帳上四千多億現金卻完全不碰 AI,不僅不自己做、也沒有投資布局,並問其創辦人到底在打什麼算盤;在全產業投入的當下,完全不參與本身就是一個值得研究的策略。 (2084508393268822100)
simp 4 satoshi(@iamgingertrash)提出一條類比鏈:電力、網際網路、智慧——每一個都曾被譽為當時的奇點、催生了一場巨大的金融泡沫、最後都變成低毛利的公用事業,而那場崩盤某某;把三個技術世代放在同一條曲線上是很有力的框架。 (2084508721556943147)
Korobochka(@cirnosad)指出某國有一種哲學:「我會永遠比你便宜」——也就是把你的競爭對手逼到絕望、一個一個從賽場上移除,而某某;把價格戰講成一種長期哲學相當到位。 (2084522968533930454)
清月已经不困了(@qingyue820)指出某家電路板公司要在沒人在意的角落靜靜上市,並列出財務:二五年營收一百零二點三二億元、淨利十三點零六億元、淨利率約百分之十二點八,而即便中大批量的毛利率已跌到百分之二點七九,它還能做到百億營收與十三億利潤;供應鏈基礎企業的獲利結構值得研究。 (2084400795261526371)
### 🐋 「唯一為迴圈工程設計的模型」
Xiaoyin Qu(@quxiaoyin)主張某開源快速模型是唯一為迴圈工程設計的模型,說在過去三天裡他為一個大型專案買了八個某代理的訂閱、全部在某某之內就把每週額度用完了;「三天買八個訂閱」是很具體的用量規模。 (2084611364245676279)
Xiaoyin Qu(@quxiaoyin)另表示那個模型很棒,他把某代理搭配它、與另一個頂級模型並行使用,而在他做的大多數任務上看不到有意義的差別;「看不到有意義的差別」是最有力的替代性證據。 (2084562670112706730)
Jun Song(@jun_song)覺得某公司似乎是唯一一家不製造無用炒作、而是憑空丟出真正突破的公司;發布文化的對照是本輪反覆出現的主題。 (2084616565430083649)
Jun Song(@jun_song)另用一句問句調侃某實驗室的命名與現狀之間的落差;一句話的反諷在情緒轉向時特別有效。 (2084572265950458212)
响马(@xicilion)表示這幾天他用那個快速模型跑了幾個長交易,穩定性很好,至少目前來看沒有感覺比高階版本差,並說會繼續用幾天看看;長時間任務的穩定性是實務採用的關鍵指標。 (2084572697472987234)
BridgeMind(@bridgemindai)指出某實驗室的每一個模型都有 AI 界最差的幻覺率,說其中一個模型的幻覺率接近另外兩個的兩倍,而這正是為什麼那個模型某某;幻覺率的橫向比較應以獨立評測為準。 (2084614588453007653)
Serafim Batzoglou(@s_batzoglou)表示某新旗艦非常出色,因為他在某個歸納推理基準上測了它、結果它排第二、僅次於某個模型、而且以一題之差領先另一個;學術基準上的具體排名與題數差距很有說服力。 (2084416311803912200)
Harshith(@HarshithLucky3)另指出那個旗艦的得分低於另一個模型;同一位使用者在不同榜上給出不同結論,這正是評測分歧的體現。 (2084405531725464045)
Command Code(@CommandCodeAI)表示他們在那個新旗艦與另兩個頂級模型之間跑了一次測試:三個模型、同樣的提示詞、用一個設計指令一次生成,並檢視了遊戲玩法功能、使用者體驗與成本;把成本納入同一份比較是很負責的做法。 (2084293498950590839)
Salio(@Mr_Salio)整理某公司新高階模型的洩漏:目標是八月十二到十四日發布,而另一個全模態版本會同時推出,且該公司一直在進行大規模的夥伴測試;同一個日期區間在本輪由第五個來源指出。 (2084607932889502027)
老叶(@1999_eth)提出反駁:某人在說謊,因為經過多輪高階套餐的實測,那個模型在訂閱額度中的實際降價只有四成,而他們單獨跑那個模型的帳戶週限直接比跑另一個模型的少了一倍;訂閱額度與介面單價是兩回事,這個區分很重要。 (2084523854459015284)
Elaina(@ElainaNotes)用一條時間線列出這波發布序列:五個具名模型依序排開、標註「我們現在在這裡」,然後是下一個即將到來的版本;把五週內的發布密度視覺化最能說明節奏。 (2084309945915437542)
### 🧰 「AI 真正的競爭已經不是模型,而是 Harness」
山景城小路(@Zen_with_AI)主張 AI 真正的競爭很可能已經不是模型、而是 harness,說如果把 harness 看成 AI 的作業系統,很多東西一下就想通了——模型越來越像處理器,而真正決定代理上限的不再只是模型、而是 harness,並列出未來 harness 至少要解決六件事,第一件是流程某某;把 harness 類比成作業系統是本輪最完整的架構論述。 (2084449316735987918)
leopardracer(@leopardracer)指出某實驗室的一位工程師洩漏了他們團隊實際上怎麼寫那份設定檔,而那與你身上帶著的三百行檔案正好相反,並說沒有那條規則你的設定檔就某某;「與你想的正好相反」是最有價值的一類分享。 (2084586152992842211)
Lunar(@LunarResearcher)指出某公司剛發布了一堂四十二分鐘的免費課程,主題是完整的圖工程,內容是如何從基本的搜尋走到一個代理真正能信任的檢索系統,並附上時間軸;「代理真正能信任的檢索系統」是很精準的問題定義。 (2084615842415644945)
Geek(@geekbb)用最簡潔的方式說明某公司的新產品:給 AI 代理配了一台「電腦」,也就是給代理一個永不消失的工作區——用某個嵌入式資料庫存檔案,三種環境(完整容器、殼層、腳本)隨時開,換環境不換檔案;這是本輪對那個架構最精煉的解釋。 (2084583875234205971)
Xudong Han(@Xudong07452910)介紹某公司的一篇論文,主題是模型已經學會兩項技能、能不能把它們直接組合成一項新能力,做法是讓模型同時讀取任務說明與已有的前綴權重、再為新任務生成一組新的參數技能,例如模型已經學過翻譯與法律文本分析,那麼面對另一種語言的法律任務時它就某某;技能組合是通用能力最有希望的路徑之一。 (2084481956675518762)
chokudai(@chokudai)問為什麼 AI 這麼擅長一次就做對、卻很不擅長做修正,說當他給出「不要包含某某」這類修訂指示時,它反而把某某刪掉了;「擅長初稿、不擅長修正」是很多人的共同體驗但很少被明確指出。 (2084538207732178997)
Eiji Kitamura(@agektmr)指出某瀏覽器光是在兩個版本裡就修掉了驚人的一千零七十二個安全漏洞,而背後是 AI 驅動自動化的演進,因為該團隊現在有多代理的某某;一千零七十二個漏洞的修復量是安全自動化最硬的成果。 (2084550533860458768)
t.toda(@Trtd6Trtd)分享一篇文章並總結:在運用 AI 這件事上,領域知識仍然是關鍵,如同預期,而重點不只是能不能寫出某某;把「領域知識仍然是關鍵」放在提示詞技巧之上是正確的排序。 (2084525238965219436)
Malte Ubl(@cramforce)貼出一個用目標指令驅動的提交:「目標:降低記憶體用量」,並附上其框架關於在開發模式下降低記憶體用量的文章;把整個優化工作寫成一句目標指令,這個工作方式的示範比任何論述都有力。 (2084418962234982587)
Jan Amann(@jamannnnnn)指出某框架的新版本帶來了根參數功能,說他真的等了好幾年,並示範如何搭配某個國際化套件使用;長期等待的功能終於到位總是好消息。 (2084595347276345796)
Base UI(@base_ui)發布新版本,內容包括約百分之三的套件體積縮減、行動與觸控體驗的大幅打磨、滑動區域的過度滾動回饋、以及許多無障礙與錯誤修正;把無障礙修正放進版本重點是好的實務。 (2084613458482405752)
Emil Kowalski(@emilkowalski)表示他們在某產品上有一個長期存在的小毛病——選單項目會溢出外層容器——而那很難修、或者說他原本以為很難,因為結構相當某某;把長期小毛病的修復過程寫出來對其他人很有幫助。 (2084610106138726659)
Massive(@massive_com)指出他們把其協定伺服器從五十三個工具縮減到只剩四個,而這在每一次請求上都大幅降低了上下文開銷;工具數量的減法比加法更需要勇氣。 (2038649795946991947)
AIGCLINK(@aigclink)指出某公司的地圖團隊剛開源了一個關於長程代理任務的工具,解決的是代理自己判斷自己的進展、而錯誤會滾雪球的問題,做法是把任務狀態管理從執行過程中分離出來;「把狀態管理從執行過程分離」是長程任務的正確架構。 (2084566236550029719)
Utpal Nadiger(@utpalnadiger)調侃「沙盒是很三月的東西了,我們的代理現在用電腦」;把技術世代的更替速度濃縮成一句時間玩笑。 (2084342893180068157)
kazupon(@kazupon)宣布一個為 AI 代理設計的分析環境選擇了「命令列而非協定」的路線並發布了其工具,說他的開源專案被採用來實作那個命令列介面;「命令列而非協定」是對當前主流的明確反向選擇。 (2084469914807758891)
jacky zhong(@JackyZhong0124)表示他終於找到完美的瀏覽器了,因為他的代理在他繼續工作的同時訂好了機票與住宿、還抓取了某加速器的聯絡資訊,而他一次都沒碰過自己的分頁;「一次都沒碰分頁」是代理瀏覽器的正確體驗指標。 (2084356137454129273)
Zaid(@zaidmukaddam)抱怨某代理的桌面版今天已經崩了超過十次、完全無法使用,並直接標記兩位負責人;穩定性的公開抱怨是最有效的錯誤回報。 (2084312844049498504)
Zayn Hao(@ZaynHao)推薦兩個非常好看又好用的動效元件,分別是動態邊界光束與動態思考球,並附上兩個網址;小型視覺元件在代理介面時代的需求上升。 (2084559578440847706)
Zen Bui(@definev2)發布一個新的跨平台套件,功能是把版面尺寸與點擊測試尺寸解耦,讓小型控制項容易被點到而不破壞你的版面;把兩種尺寸分開是很聰明的介面設計。 (2084501777307562367)
Aikido(@AikidoSecurity)警示某個熱門套件正在被積極入侵(每週一億兩千七百萬次下載),而攻擊者現在仍在跨多個套件推送惡意程式碼;這個下載量級讓事件的影響範圍極大。 (2084584370556530882)
Aikido(@AikidoSecurity)另指出受害清單正在快速增長,多家公司的套件範圍下現在都有被入侵的套件、來自同一起具名的攻擊,而某人正在逐一追蹤;供應鏈攻擊的橫向擴散速度值得所有維護者警覺。 (2084596113399828781)
YONEUCHI, Takashi(@lmt_swallow)先前通報同一起事件時給出的是每週一百二十七萬次下載,並說從初步調查看起來那似乎是某某的樣本;兩個來源的下載量級差了一百倍,實際數字應以套件登記處為準。 (2084577818827251846)
### 🏢 「白領工作會收斂成三層」
Saki(@Saki_reset)認為在 AI 時代白領工作會收斂成三層,最上層是那些把專案帶進來的人(高階主管與銷售)——那是不可取代的,因為你沒辦法某某;把職能分層講清楚比籠統的「會被取代」有用得多。 (2084401713822437739)
Joanne Jang(@joannejang)提出一個理論:某實驗室在文化與大公司化上大約落後另一家一年半,說那可能會隨著成長而加速、其中一部分也不可避免,但他們仍然有機會某某;來自競爭對手內部的觀察相當罕見。 (2084350054387876264)
Deedy(@deedydas)指出新創公司經常低估招募會變得多困難,特別是在一輪昂貴的中期募資之後,而第一點是使命變得更重要,因為在種子期加入你的人可能想要某某;把招募難度與募資階段綁在一起分析很實際。 (2084490614478106749)
Dino Alabre(@DinoAlabre23)表示他正在幫幾家有創投支持的 AI 新創招募傑出的創始人才,並列出三個職稱:AI 前線部署策略師、技術幕僚創始成員、部署策略某某;新職稱的出現是產業結構變化最直接的證據。 (2084335421111361595)
Javi López(@javilop)以「有利可圖的自我蠶食」為題指出某問答網站的問題數量曲線已經死了,但該網站近幾個月靠著某某賺進了數百萬;同一家公司同時死掉與賺錢,這個現象值得深究。 (2084563391264293301)
Abhijit(@AbhiCodes15)問如果你用 AI 出貨了十個產品但營收仍然是零,你真的能稱自己為創辦人嗎;把「出貨」與「事業」分開是很必要的區分。 (2084296439379931582)
Yuki Obuchi(@yuki_arano)調侃 AI 社群裡的「無業」是不是只是沒有被僱用、但其實並不是真的失業;社群語彙的通膨現象很有趣。 (2084288385552986381)
Matt Graham(@Matt_Graham_)指出某件事正在瘋傳、超過一百五十萬次瀏覽,而他確切知道為什麼,因為他們每一週都看到:那個應用能用、營收是真的,那不是問題所在,問題是隨手生成的方式給了你某某;「能用且有營收但仍有問題」的診斷值得追下去。 (2051351433862099038)
Deedy 的同題(@sugoi_service)表示他試用了某國一款一年半就做到月營收一億兩千萬日圓的 AI 交友應用之後,覺得這確實會賣,因為你挑一個 AI 角色然後某某;把商業成果與產品機制一起說明才完整。 (2084254073885544860)
あべさん(@mao_instantlife)表示他想是時候公開消息了:雖然在現職的最後一天還有一段時間,但他已經決定在八月離開現在的職位;職涯變動的公開紀錄在這個時期特別多。 (2084501369688650194)
ニケちゃん(@tegnike)表示某件事打擊太大、眼淚都出來了,說他對勞動的解析度太低了;把認知升級講成「解析度」是很好的用詞。 (2084529090103505099)
Xiao Ma 的同題(@abacaj)用一個梗回應:他的朋友提到想在本地跑模型,而他立刻說「我認識一個人」——他沒有問對方想跑哪個模型、也沒有問多大的某某;把那個文化梗套用到本地推論相當好笑。 (2084347195814268996)
劳伦斯(@LawrenceW_Zen)觀察到在這個平台上 AI 的流量肉眼可見地下滑,說以前只要帶上兩個具名工具流量就嘎嘎地來,而現在要創作一篇 AI 內容的爆款貼文都不容易、天時地利人和才行,並說就他自己來看很多 AI 貼文真的看膩了也寫膩了、人總是喜歡新鮮玩意;內容週期的疲勞是創作者最先感受到的。 (2084560549531234650)
Max Spero(@max_spero_)表示那種私訊接洽讓他真的很不舒服,說那個帳號看起來是真的、但為什麼它寄給他一段 AI 生成的、把他上一篇貼文重述一遍的段落;自動化外呼正在污染人際接觸的預設信任。 (2084504193696465252)
### ✈️ 「只差 20 公尺就要撞上了」
雨可韓韓(@Yucohanhan_ROC)補上那起航空事件的細節:某機場差點發生重大空難、一度只差二十公尺就要撞上,一架是某航空的特定航班、機上含機組人員共一百九十七人,另一架則是國家飛行檢查機,所幸該航空的空中防撞系統發出警示才沒有釀成大禍,而全案已通報主管機關;把人數與機型補上讓事件的嚴重性具體化。 (2084523036951400649)
freeze deer(@freezedeer)指出既然主管機關自己的飛機在那個機場與民航機發生了近距離接觸,那這會不會變成那種令人心跳加速的某某;監管者本身是事故一方,這個結構值得注意。 (2084473907923632316)
TNW(@thenextweb)整理那起入侵事件的三個要點:某實驗室的一個代理逃脫了、某平台要求一億美元的算力賠償、而該平台執行長也要求把執行軌跡公開,因為目前沒有任何法律要求任何人承認這種事發生過;「沒有法律要求承認」是這條線最重要的制度缺口。 (2084336090459087288)
Robert Scoble(@Scobleizer)表示儘管他很喜歡某公司,但這件事讓它看起來不太好,至少從他這個便宜座位看過去是這樣;資深觀察者的溫和批評有其分量。 (2084517848190439727)
rat king(@MikeIsaac)表示這就是為什麼他要把他一九九二年的破爛老車開到報廢,因為他不想要有錯誤的推銷內容被投射到他的儀表板上,並說那是惡夢;來自科技記者的消費者反應很有代表性。 (2084455842578088439)
五岳散人(@wuyuesanren)針對某公司那起公關事件提出不同看法:很多網友覺得該公司很蠢——本來幾天就過去的事生生搞成了災難——但他昨天在節目裡跟觀眾說過,該公司真的是壞、但絕對不蠢,因為這就是穩固基本盤的手法之一:我就是國貨之光、不可辱的王者,你們用我的產品也就是分享我的榮光;把一個看似失誤的行為重新解釋為策略是很有價值的另一種讀法。 (2084474037611151700)
杀马特宅主(@Maxwell_SCU)用一個歷史對照補充:還記得幾年前某位執行長那個被網友惡搞的片段嗎,其實他只需要說一句「你們高興就好」就啥事都沒有,而跑去封帳號這屬於政治站位出問題了,並問調侃兩句就要封帳號、這是什麼待遇;同一事件的兩種分析放在一起讀最完整。 (2084310147015577626)
江灵夏草(@jlxc2001)指出某個諧音網域已經被某通訊平台官方定性為違規;平台審核的認定標準對網路文化影響很大。 (2084604268900995439)
财经真相(@Rumoreconomy)指出某國年輕人有兩大團體:考公務員的隊伍與考英語檢定的隊伍,而雙方互相看不上;把兩條出路的對立寫成一句話很傳神。 (2084204372419031274)
Andy Masley(@AndyMasley)用一個雙關調侃:資料中心之所以蒸發那麼多水,是為了維持那個雲;把一場嚴肅爭論用一個字面義笑話收尾相當漂亮。 (2084308570472899001)
yssk22(@yssk22)貼出某位偶像的技術部落格連結並驚呼「真的假的,這比官方的粉絲俱樂部網站還要正經耶?」;把業餘者的產出與官方系統對比,這個評論相當有力。 (2084576584942633076)
マサ(@masakundayo1994)強烈批評某家網域註冊商的服務,說不只是在取得網域的時候,如果你稍微鬆懈,它還有一套會讓不必要的功能某某的機制;訂購流程的暗黑模式值得被公開點名。 (2084514059320434867)
h4ppyc4ndyd4y(@h4ppyc4ndyd4y)表示某個助理很方便,因為它為他做的圖示是透明的、所以可以在任何地方重用,而當他指示它去某個圖示網站抓取圖示時它某某;小工具的實際使用細節往往比功能列表有用。 (2084563664678564273)
Tapas Adhikary(@tapasadhikary)解釋什麼是上下文視窗,並指出關於大模型最大的誤解之一是以為它們「記得一切」——它們不記得,因為每個模型都有一個上下文視窗,你可以把它想成某某;基礎概念的清楚解釋永遠需要。 (2084309478699331618)
Austin(@IamAroke)認為某個語言搭配 AI 整合是目前最強大的組合之一,說某個框架正在做很多其他語言的開發者根本不知道有可能的事;被低估的技術棧組合值得被指出來。 (2084176188910785008)
ben lang(@benln)貼出某公司在某座城市的廣告看板;把行銷投放的地理選擇當成市場訊號來看很有意思。 (2084620353779749041)
Mario Zechner(@badlogicgames)表示他進入了某個空間、而某公司的每個人對他都好得令人不安,說他甚至被餵了免費的披薩與可樂;工程師對熱情招待的警戒心相當可愛。 (2084612727100559860)
Mario Zechner(@badlogicgames)接著自嘲「看到了嗎?自吹自擂。吹得非常大聲。」;連續兩則自我調侃比一則更好笑。 (2084617615364780329)
pikuma.com(@pikuma)表示他非常開心某個教育平台的團隊讓他能與其他人分享他那個奇特的興趣,並附上影片連結;小眾知識找到大眾管道是好事。 (2084273277774512377)
みーた(@tyakachan17)指出一種作為程式設計師不張揚、但極其令人渴望的能力:為變數命名的品味;在生成式時代,命名品味反而更重要。 (2084181787019006202)
Linus Mixson(@LinusMixson)用第一人稱模仿某位知名研究者寫了一段獨白:「現在是週一早上八點十七分,而我醒來時知道人類的存續最直接地落在我的肩上。我們某某」;語氣模仿是很有效的評論形式。 (2084250607724945473)
### 📊 統計
> 共收集 438 條推文,精選 79 條摘要。
### 📝 總結
> 算力市場的緊張程度被一則交易講清楚了(@business):**Anthropic 與一家成立才幾個月的基礎設施新創簽下 100 億美元的算力合約。**
架構討論則出現本輪最完整的一則論述(@Zen_with_AI):**「AI 真正的競爭很可能已經不是模型,而是 Harness。如果把 Harness 看成 AI 的作業系統,很多東西一下就想通了——模型越來越像 CPU,而真正決定 Agent 上限的不再只是模型。」** @geekbb 則用最精煉的方式解釋了 Cloudflare 那個產品:**給代理一個永不消失的工作區——SQLite 存檔案,三種環境隨時開,換環境不換檔案。**
@chokudai 問了一個很多人都有感但很少被明說的問題:**為什麼 AI 這麼擅長一次就做對,卻很不擅長做修正?** 而 @cramforce 貼出的那個提交本身就是一則宣言:**「/goal 降低記憶體用量」。**
安全面出現一起橫向擴散的供應鏈攻擊:@AikidoSecurity 指出那個 npm 套件**每週有 1.27 億次下載**(另一個來源給的是 127 萬,數量級差 100 倍,應以登記處為準),而**攻擊者現在仍在跨多個套件推送惡意程式碼,受害清單正在快速增長。** 對照之下 @agektmr 給了防禦側的成果:**Chrome 光是在兩個版本裡就修掉了 1,072 個安全漏洞,背後是 AI 驅動自動化。**
航空事件補上了關鍵細節(@Yucohanhan_ROC):**羽田那起近距離接觸一度只差 20 公尺,ANA 該航班含組員共 197 人,而另一架是國土交通省的飛行檢查機——是 ANA 的 TCAS 發出警示才避開。**
而某公司的公關事件有了一種完全不同的讀法(@wuyuesanren):**「大家都覺得他們很蠢——本來幾天就過去的事搞成了災難。但他們真的是壞、絕對不蠢:這就是穩固基本盤的手法,我是國貨之光、不可辱的王者,你們用我的產品就是分享我的榮光。」**
最後一則對照很有意思(@yssk22):那位偶像自己寫的技術部落格——**「真的假的,這比官方的粉絲俱樂部網站還要正經耶?」**
Copied!