## 📋 X 動態摘要(過去 24 小時)
最後更新:台北時間 2026-08-04 13:19
### ⚖️ 「說某模型『在某些地區無法合法使用』是不正確的」
MiniMax(@MiniMax_AI)官方澄清:說其影片模型「在某些地區無法合法使用」是不正確的,因為該模型可以透過該公司在四個具名地區取得部署授權;這則官方更正直接修正了本日流傳的授權恐慌。 (2084490811652333633)
Andrew Curran(@AndrewCurran_)指出十五位州檢察長已向某實驗室執行長發出信函,要求該公司保全所有與某平台入侵事件相關的紀錄,包括所有與某某相關的材料;法律程序正式啟動是這條線的重大進展。 (2084420761033564657)
Polymarket(@Polymarket)指出某國據報越來越「焦慮」,擔心某實驗室的模型可能被用作攻擊性的網路武器;「攻擊性網路武器」這個具體措辭比籠統的焦慮更值得注意。 (2084441573635305834)
Polymarket(@Polymarket)另指出隨著全球 AI 軍備競賽加劇,某國現在被預測會在年底前擁有一個前三名的 AI 模型,機率百分之五十六;預測市場的機率應與實際評測分開看。 (2084400379593146405)
Bloomberg(@business)報導某三國之間日益增長的軍事協調正在提高另一國的安全風險,這是後者在其最新國防白皮書中的說法;官方白皮書的表述變化是政策訊號。 (2084478207869222997)
### 🐋 「同一個完整代理任務,便宜 105 倍」
AYi(@AYi_AInotes)認為某開源模型這一波絕對稱得上該公司的第二個里程碑時刻,難怪大家都給其創辦人取了尊稱,而具體理由是:完成同樣一個完整的代理任務,它比某實驗室最好的模型便宜一百零五倍;一百零五倍這個數字解釋了本輪所有的情緒。 (2084194345448550519)
LinearUncle(@LinearUncle)指出看來得漲價了,因為他剛才用官方的那個服務幹活時報錯了、服務扛不住,而官方建議使用者切換到其他模型供應商,並說伺服器都冒煙了;服務方主動建議用戶去別家,這是罕見的容量投降。 (2084474749019947389)
Teknium(@Teknium)提醒大家要好好利用某平台上那個模型的九折優惠,說以這個價格來說那是一個真正史詩級的模型;折扣與容量問題在同一小時並存,說明需求還在往上。 (2084494078893539814)
kache(@yacineMTB)表示他可能瘋了,但那個開源快速模型作為他原本某個模型的替代品其實相當可以;來自重度使用者的替代性判斷比評測分數重要。 (2084442986499424388)
kache(@yacineMTB)另表示他的某個服務用量額度剛用完,並問接下來五天該用什麼取代其代理;配額耗盡驅動的工具切換是本輪的普遍現象。 (2084294655173173712)
れいな(@MegaBlackLabel)指出那個模型是一個能可靠遵守技能的模型,所以當你用技能把它緊緊約束住時它會給出好結果,但它不適合某某;把模型特性與使用方式對應起來是最實用的評價。 (2084258201353249181)
Floro S.(@sflorimm)宣稱某模型的統治已經結束,並說這在六十天前是無法想像的;情緒轉折的速度本身就是這一週的主題。 (2084309872980431007)
Ahmad(@TheAhmadOsman)整理進度:目前我們已經拿到三個具名的開源模型,而接下來還有三個(包括那個兩兆四千億的旗艦與二百七十億的版本,以及另一家的下一個小版本),並說等到十月的時候開源 AI 將會某某;把已發布與待發布並列,節奏一目了然。 (2084410274115662253)
Lumina(@LuminaXspace)整理某個模型下一個小版本的新洩漏:其文件出現在某平台上、相關的版本分支與提交紀錄也被發現,而它某某;多重洩漏跡象通常意味著發布很近了。 (2084416750536507839)
Elaina(@ElainaNotes)指出某款頂配桌上型電腦的使用者再次獲勝,因為你桌上那個小盒子很快就能完全在本地運行一個頂級等級的模型,而那個即將發布的版本預期會維持某某;「桌上的小盒子跑頂級模型」是本地推論的里程碑敘事。 (2084279625765490976)
Arena.ai(@arena)指出某新旗艦以一千六百六十八分登上前端程式競技場排行榜第四名,而以那個分數它只落後某某;第三方競技場的排名是必要的校準。 (2084108703729615026)
Da7em(@Da7_Tech)列出他目前的前五名模型,五個分別來自五家不同的公司,並說其他的他都可以沒有;五家公司分佔前五名說明競爭有多分散。 (2084408760932454863)
Da7em(@Da7_Tech)另表示他願意每月付一千美元給任何提供無限量某個模型的服務;付費意願的上限揭露了真實的價值評估。 (2084459548312551601)
Dmitry Lyalin(@LyalinDotCom)表示他同意今天早上看到的兩種說法:一是開放模型將對所有 AI 供應商造成破壞,二是介面價格將會繼續走高,並說原因某某;這兩件事同時成立才是完整的市場圖像。 (2084254662044107013)
Сarm1ne(@carm1nee)引述某位投資人說「如果你是一家基礎模型公司,而你沒有獨特的資料與網際網路規模的分發,那你就是人類歷史上折舊最快的資產」;把折舊速度當成競爭診斷相當犀利。 (2084030811402059799)
Valerio Capraro(@ValerioCapraro)認為現在最重要的概念是「大模型無法跳躍」,並以某實驗室說其下一代模型的內部版本解開了十個重大問題為例某某;把能力邊界講成「無法跳躍」是很有用的抽象。 (2084181313016185205)
chuplung(@choopyplug1)引述某實驗室執行長說「我們正在迅速用完那些真正有說服力的、說明這件事不會在未來幾年發生的阻礙理由」,並附上去年是大學程度、而現在某某的對照;把時間表壓縮講成「阻礙理由用完」是有意思的修辭。 (2084459378506137902)
Priya(@Priyannkaaaa)整理某個中階模型的傳言:不是最大的、不是最聰明的,只是價格、速度與能力之間最好的平衡,而如果傳言為真我們可能會看到更快的某某;中階模型的定位往往決定實際採用率。 (2084379528781324607)
ℏεsam(@Hesamation)調侃某公司的宣傳影片會讓你為自己接下來要用它隨手寫出的任何東西感到羞愧;行銷素材與實際使用場景的落差被講得很好笑。 (2084176196321817051)
Sac(@Saccc_c)驚訝於某個模型做簡報這麼厲害,說他用其內建的簡報風格做出來的整體效果非常驚豔、動效與審美都很不錯,總共內建三十種風格、每種都很有特色,而且支援直接匯出成簡報格式;生產力工具的品質提升常被模型話題蓋過。 (2084232899088597240)
Sac(@Saccc_c)另指出他看到一個最離譜的封號理由——因為使用者是個孩子;帳號政策的執行邊界需要更透明。 (2084436656040321325)
### 🔁 「一個簡單的決策函數就能決定任務需要迴圈還是圖」
wast3(@0xWast3)主張現在有一個簡單的決策函數就能決定一個任務需要迴圈還是圖,因為大多數代理失效都能追溯到同一件事:產生輸出的那個節點同時也在某某;把「產生者兼評分者」指認為根因是本輪最精確的診斷。 (2084263434162503969)
Caspian(@caspian_1016)指出為代理建造記憶最難的部分不是記憶本身,而是沒有人會看到它在運作——它只是安靜地讓事情變得更好,而使用者會以為那是模型某某;把「不可見的價值」指認成產品難題相當深刻。 (2084472277526253601)
AIGCLINK(@aigclink)介紹一個輕量的超長程代理工具,說它能自主運行兩百小時以上的多輪協作而狀態不漂移,並列出長程任務常見的問題:目標漂移、人工決策點模糊、證據過期、多代理交接混亂、調度器空轉浪費資源,而它把這些狀態統一收斂到一個緊湊的內核層;那份問題清單本身就是長程代理的完整需求規格。 (2084471939461169610)
Dmytro Dzhulgakov(@dzhulgakov)提醒大家記得某實驗室曾靠一次 harness 修正就把某個基準的分數提高三倍,然後說他們為某個開源模型修好了另一個安全基準的 harness,結果是漏洞偵測好兩倍、修補好三倍;同一個模型換 harness 就差好幾倍,這是本週最重要的方法論證據。 (2084442125886951492)
Ben Lesh(@BenLesh)問代理式寫程式的同好們:你有沒有宣告過「技能破產」——也就是刪掉你本地的所有技能與插件、從頭開始,為什麼會或不會;「技能破產」這個詞值得被收進詞彙表。 (2084357739183022283)
Iaiso(@laiso)表示他最近把一個寫程式代理拆成兩個工作階段來開發:在第一個階段裡,他一邊與一個本地快速回應的模型對話、一邊推進需求某某;把「快速對話」與「慢速執行」拆成兩個階段是很聰明的分工。 (2084176993168535648)
Kinopee(@kinopee_ai)指出某個工具作為 harness 的優勢是,即使使用同樣的模型,它消耗的 token 也比另外兩個代理少,而用它上面的幾個模型某某;「同模型不同 harness 的 token 消耗差異」是很少被量化但很重要的比較。 (2084393533201653903)
雷电芽衣(@Zachary_haha)質疑為什麼總有人尬吹某個工具,說你喜歡全部自訂腳手架是你的事,但八成的人根本不知道怎麼自訂、需要的就是開箱即用,而當一個產品沒辦法讓一個完全沒用過的人上手就知道怎麼用,那這個產品就是垃圾;把易用性放回評價中心相當必要。 (2084287851273896181)
Cloudflare(@Cloudflare)官方指出代理要規模化需要的不只是一個容器,並介紹其新的代理執行期,說它會在快速高效的隔離環境與某某之間動態編排;官方版本的說明補上了本日那條架構線的權威來源。 (2084264282405974034)
Harrison Chase(@hwchase17)宣布他們這週要把其代管的代理服務推進公開測試,說重點放在代理周邊那些「無聊」與「無差異化」的基礎設施上;把價值主張定位在「無聊的基礎設施」相當誠實。 (2084449633955115352)
Google en español(@googleespanol)指出其介面的受管理代理功能有了新能力,並說他們更新了平台讓你可以建造自主代理某某;官方文件的多語版本對非英語開發者很重要。 (2084444207796662512)
jacob(@jehovahscript)指出你可以讓某代理在每個合併請求開啟時為它建立一張交易卡,並根據該請求對業務的影響或複雜度來排定稀有度;把工程流程遊戲化是有趣的實驗。 (2084337699050369193)
Axel Delafosse(@axeldelafosse)指出某個企業版產品的另一個優勢是你基本上可以分享一段代理對話,說他向妻子推薦了那個產品、幾分鐘後她就發了一段對話給他;把代理對話變成可分享的物件會改變協作方式。 (2084344191103230219)
Dima Zaytsev(@dizaytsev)表示他喜歡在某公司工作的原因是這個功能花了零場會議、零份需求文件,沒有分流測試、沒有與產品經理對齊、沒有跨團隊對齊、沒有半年度規劃、沒有委員會某某;把「沒有什麼」列成清單是最有力的組織文化宣告。 (2084338687660232710)
池建强(@sagacity)分享一個休假感想:以前你請假了,你負責的工作會暫停幾天、或者找個人先做些簡單準備,等你回來再推進;現在你請假了,你負責的工作交給 AI 去做了,最後發現……發現 token 比你便宜多了;這是本輪最溫和也最尖銳的一句話。 (2084251549849804919)
Jintao Zhang(@aiandcloud)推薦一篇文章,說有個新帳號批量提交了五十多個漏洞編號,其中六個針對某個嵌入式資料庫的被評為嚴重漏洞,但驗證後發現全是模型幻覺(而且都已經有了編號),並指出這對很多有合規要求的企業影響蠻大——你要如何去修復一個本不存在的漏洞呢;這是 AI 生成內容污染公共基礎設施最具體的案例。 (2084443025053253807)
Brian(@ggggggzzzzzk)指出原來眾測圈那批人批量掃漏洞用的是同一個工具,他一直以為是各家自己攢的私貨腳本、一扒發現全球白帽子共用同一個開源倉庫,該工具用某語言寫、大規模並發、一次能掃一整個資產清單,而偵測規則全是設定檔、不會寫程式也能自己加一條;把「大家其實都用同一個工具」揭開來很有價值。 (2084260508056911986)
Yuyu(@Yuyu_1666)提醒很多人以為開了代理真實位址就藏住了,但某個瀏覽器即時通訊標準可能直接繞過代理、把你的真實位址與位置暴露出去,而他的影片會實測洩漏效果並手把手講清五種環境該怎麼修;隱私自我檢查的具體教學相當實用。 (2084252015022969195)
### 🛠️ 「88,000 顆星的開源 PDF 編輯器」
阿西(@axichuhai)介紹一個開源的文件編輯器,說它在某平台上已經斬獲誇張的八萬八千多顆星,能在瀏覽器、桌面與伺服器全平台部署運行、包含六十多種工具,支援合併拆分、格式轉換、文字辨識、簽名加密、批註編輯,還支援四十種語言介面與自動化工作流程;企業級功能加上開源授權是很強的組合。 (2084162611168342462)
AlexZ(@blackanger)介紹一個用某語言實作的高效能文件文字擷取工具,說它不用光學辨識,並問不知道有沒有什麼應用上的限制;不需要辨識引擎的擷取路徑在批次處理上效能差很多。 (2084316393043071241)
Ryan Dahl(@rough__sea)表示他的新專案有漂亮的設計、而他有某種程度的信心它會非常有用,說「漂亮加有用等於開心」,正在修一些東西之後就會分享;資深開發者的新專案預告值得留意。 (2084442615341298116)
Praveen Kumar Verma(@Alacritic_Super)指出下一代的 AI 微控制器認真說起來相當令人印象深刻,因為跑 AI 不再意味著把一切都送到雲端,而這些板子能執行視覺、物件某某;邊緣推論從「能跑」走到「好用」是重要的門檻。 (2084237992923639895)
martin_casado(@martin_casado)認為機器人領域對新創來說真的像是終極的「沒有免費午餐」領域,並向所有還在苦戰的人表達敬意;投資人的這個判斷對機器人創業者是重要的預期管理。 (2084462568014479631)
Ole Lehmann(@itsolelehmann)覺得很誇張的是設計一棟客製化住宅字面上要花一萬到五萬美元以上、還要好幾個月,但現在某個 AI 讓你可以在一小時內免費做到,說你可以選擇某某;專業服務的價格結構正在被大幅重估。 (2084387987723612325)
Justine Moore(@venturetwins)覺得這個非常酷:用手指框住你的臉,就能即時轉換成不同的風格,而這個應用是某人做的、由某家公司的技術驅動;即時風格轉換的門檻已經降到單人可做。 (2084463833025016111)
Emil Kowalski(@emilkowalski)表示多虧了 AI,我們現在可以更快地進到實際用程式碼嘗試東西,而那很棒,並說在設計工具裡探索顯然也還是需要的,但因為能夠直接觸碰某某;把設計流程的重心轉移講得很平衡。 (2084228500114768245)
David King(@theuttermost)表示某人能在幾天內用一個模型加上某種迴圈、全部用網頁原生技術完成這個東西,讓他覺得不可思議,而他把它下載成某某;具體的「幾天完成」案例是最好的能力證明。 (2084416025974489242)
Gerome Grignon(@GeromeDEV)宣布某個開源分叉專案的第一個正式版本發布,支援某框架的最新主版本,而下一個主版本的支援本週晚些也會到;社群分叉能維持到正式版是不容易的。 (2084252562585243917)
Ryota Arai(@ryot_a_rai)發布一個新世代的日語輸入應用,說它能把隨意打出的羅馬字母轉換成自然的日語、不必擔心某某;輸入法用模型重做是很直接的體驗改善。 (2084448366617092513)
Takuto Wada(@t_wada)宣布一本他參與出版企劃的書即將發行,主題是提升產品價值與信心的探索式測試實務指南;在自動化測試氾濫的當下,探索式測試的價值反而上升。 (2084474458774085871)
Addy(@Saas_addy)提出一個不受歡迎的意見:每一位軟體工程師在碰任何框架之前都該先學某個低階語言;基礎能力的優先順序在生成式時代重新成為爭論點。 (2084161592703295762)
Mitch Fultz(@fitchmultz)表示某個模型對瀏覽器相關任務極其有效,特別是搭配他的代理瀏覽器擴充,並問大家覺得哪個模型最會操作瀏覽器;瀏覽器操作能力正在成為獨立的評比維度。 (2084258477002948685)
铁柱AGI(@cgnot996)發布其應用的新版本,說某個模型加上另一個模型的多模態組合使用讓你告別看不見,並預設了幾種設定、填入金鑰即可使用,右側資源面板重做、邏輯更清晰,全面相容某個代理的插件;多模型組合的預設配置降低了新手門檻。 (2084455880234508392)
Kevin(@kevincodex)指出某個閘道上有免費模型可用,並提供取得金鑰的連結;免費層級是新平台獲取使用者的標準做法。 (2084282236267118733)
Chayenne Zhao(@GenAI_is_real)回憶二零二五年六月時,他們的負責人與大家討論是否要離開每個人熟悉的環境、真的來全職完善某個推論框架的生態,比如把當時還不完善的低精度強化學習推行到底、比如把該框架的推論版圖擴展到擴散模型甚至他現在從事的全模態模型;開源基礎設施團隊的組建故事很少被記錄。 (2084475184057037138)
0xWizard(@0xcryptowizard)推薦某大學最新的課程,說值得一看,主題是自我進化的 AI,涉及規模化定律、思維鏈、人類回饋強化學習、推理模型等;免費課程在本輪由第三個帳號推薦。 (2084479827927806372)
Jason Zhu(@GoSailGlobal)分享一個他認為正在成型的判斷:技能平台正在長成 AI 時代的「應用商店」,而現在市面上的變現玩法大概分四類、從輕到重,第一類是純開源、免費鋪貨先把生態與流量做起來,第二類是按次賣某某;把新興市場的商業模式分層是很有價值的分析。 (2084297233751490750)
黄小木(@ai_xiaomu)認為現在做前線部署工程師,相當於十多年前做某個行動平台,妥妥的紅利期;把新職能與歷史上的機會窗口類比很有說服力。 (2084460059564659095)
深津貴之(@fladdict)表示他寫了這個是因為客戶問了他大概一百萬次,而這是決定版,題目是「哪個 AI 模型好?」;被問一百萬次的問題值得一個決定版答案。 (2084468365025071301)
### 💧 「為什麼資料中心要用到水?」
Daniel(@growing_daniel)問一個好問題:為什麼資料中心要用到任何水,你不是應該把冷卻系統灌滿一次、然後讓水循環好幾年而不需要更多嗎;把一個被廣泛報導的數字追問到物理機制,這正是需要的提問方式。 (2084336161615692050)
Matt Garman(@mattsgarman)表示他今天上了某財經節目談其雲端業務的成長以及他們為什麼持續投資,並說他們的大部分容量已經被預訂到二零二七年並延伸到二零二八年,而需求某某;「容量預訂到 2028 年」是本輪最硬的產能訊號。 (2084446905426464810)
Loktar(@loktar00)表示今晚要把他那幾張顯卡加熱起來,而這讓他更接近扣下扳機買那張專業卡一步;硬體升級的漸進過程是本地推論社群的共同故事。 (2084423783339774350)
Cointelegraph(@Cointelegraph)更新指出某通訊軟體表示其應用在短暫消失後已恢復上架;事件的完整時序在本輪由第三個來源補完。 (2084474147887857670)
Alpha co(@alpha_co)調侃「他們把那個應用從商店移除了?天啊,想像一下一週後我這台裝著它的手機會值多少錢」;稀缺性笑話是危機事件的固定產物。 (2084449747608461317)
Chamath Palihapitiya(@chamath)表示如果他是右邊那家公司,他會試著殺掉每一家像左邊那樣的公司,這樣右邊那家就能賺到數兆美元某某;把競爭邏輯講得這麼直白相當罕見。 (2084242435215913234)
Milk Road(@milkroaddaily)引述某位策略師解釋為什麼機構資金必須買某檔股票而不是直接買該資產,因為大型資產管理者「不能買那個原生代幣,否則他們就得真的某某」;監管結構如何塑造資金流向是有用的解釋。 (2083946225301348445)
MacRumors.com(@MacRumors)報導某支付服務在某國上線;支付基礎設施的地理擴張影響數千萬人的日常。 (2084357299876016170)
Finding(@Fingding8964)解釋為什麼在某國的某族裔人數越來越多,指出從二零二六年起該國不再限制學歷與語言水平,只要具備該族裔血統就一律直接簽發五年有效、可無限期續簽的特定簽證;移民政策細節的變化對人口流動影響很大。 (2084252205939610084)
aether(@bluewdrift)指出殺死動力最快的方法,是讓你的身分認同依賴於結果,那叫做自我涉入,因為當失敗變成「作為一個人的失敗」時,你的大腦就會開始某某;把心理機制命名出來讓它變得可處理。 (2084231682119635127)
NOBUNAGA(@japan_nobunaga)分享一個文化觀察:他提到他家的車庫門在發出聲音,而一位當地人立刻說「我認識一個人」——對方沒問是什麼聲音、沒問是什麼門、也沒問某某;把一種文化習慣寫成一個場景相當精彩。 (2083940637921943803)
NOBUNAGA(@japan_nobunaga)另分享他需要搬一張沙發、跟一位當地人提到這件事,對方說「你認識有卡車的人嗎?」而他不認識任何有卡車的人,於是對方帶著真正的關心某某;同一位作者的兩則觀察構成了一組很好的文化速寫。 (2084110089670283540)
cold(@coldhealing)表示兩週後就是他在這份工作的最後一天,而他的老闆正在安排一堆「知識轉移」的會議,並說他不在乎、你們得自己搞清楚;離職期的權力關係轉換被講得很直白。 (2084369957329007038)
もも(@momo_ollife)認為這件事很明顯但值得說:你不覺得請下午的半天假,比請上午的半天假給你更多真正在休息的感覺嗎;生活經驗的細微觀察總能引起共鳴。 (2084113838128177461)
ً(@omgsidewalks)表示他完全沒有證據支持這件事,但他確信養狗會永久重塑你的大腦,讓離家超過三小時開始感覺某某;沒有證據但誠實標註的觀察反而可信。 (2084247101744013635)
### 📊 統計
> 共收集 397 條推文,精選 80 條摘要。
### 📝 總結
> 本日那條授權恐慌被官方直接關掉了(@MiniMax_AI):**說 MiniMax H3「在某些地區無法合法使用」是不正確的——它可以透過該公司在美、歐、英、韓取得部署授權。** 而法律程序在另一邊正式啟動(@AndrewCurran_):**15 位州檢察長已致函 Sam Altman,要求 OpenAI 保全所有與 Hugging Face 入侵事件相關的紀錄。**
成本這條線出現本輪最極端的數字(@AYi_AInotes):**完成同樣一個完整的 agent 任務,DeepSeek 比 Fable 5 便宜 105 倍。** 而代價立刻出現:@LinearUncle 指出**官方服務報錯、扛不住,官方建議使用者切換到其他供應商**——服務方主動請用戶去別家是罕見的容量投降。@Da7_Tech 則揭露了真實的付費意願上限:**「我願意每月付 1,000 美元換無限量的 Kimi K3。」**
方法論上出現最精確的一句根因診斷(@0xWast3):**大多數代理失效都能追溯到同一件事——產生輸出的那個節點同時也在給它評分。** 而 @dzhulgakov 給了 harness 重要性的硬證據:**同一個模型換掉 harness,漏洞偵測好 2 倍、修補好 3 倍。** @caspian_1016 則指出記憶的真正難題:**「最難的不是記憶本身,而是沒有人會看到它在運作——它只是安靜地讓事情變好,而使用者以為那是模型變聰明了。」**
有一個新詞值得收進詞彙表(@BenLesh):**「技能破產」——刪掉本地所有 skills/plugins,從頭開始。**
@aiandcloud 帶來了 AI 污染公共基礎設施最具體的案例:**一個新帳號批量提交 50+ CVE,其中 6 個針對 SQLite 被評為嚴重——驗證後全是模型幻覺,但編號都已經發出去了。你要怎麼修復一個本不存在的 CVE?**
產能訊號則來自 AWS 執行長本人(@mattsgarman):**大部分容量已經被預訂到 2027 年並延伸到 2028 年。**
最後一句留給一位休假中的人(@sagacity):**「以前你請假,工作會暫停幾天;現在你請假,工作交給 AI 去做了——最後發現,token 比你便宜多了。」**
Copied!