KeyFrame內部研究專用
每日

今日 KeyFrame

管線分析的每一部影片,最新的優先。每張卡片都直接連回原始影片。

7月5日星期日

17
Top Open-Source GitHub Projects : Ansible, Supabase, The Agency, OpenWiki & sim-use #272
13 min
GitHub 熱點中文7月5日

Top Open-Source GitHub Projects : Ansible, Supabase, The Agency, OpenWiki & sim-use #272

ManuAGI - AutoGPT Tutorials

  • AI智慧體框架成為核心 — The Agency、Craft Agents、FirstMate等專案專注多智慧體協作,支援任務委派、工作流編排,幫助開發者構建可擴充套件的自動化系統。
  • 全棧開發工具生態完整 — 從後端基礎設施(Superbase的Postgres + 實時功能)、構建自動化(Apache Maven)到前端自動化(SimUse的瀏覽器控制),覆蓋整個開發週期。
  • 知識管理與上下文儲存是關鍵 — CogniKogni(知識圖譜)、OpenWiki(AI維基生成)解決AI系統的長期記憶和上下文檢索問題,讓智慧體能追蹤工作歷史。
A1 Agent: New FREE Chinese AI is INSANE!
7 min
AI 技術英文7月5日

A1 Agent: New FREE Chinese AI is INSANE!

Julian Goldie SEO

  • 性能定位清晰:Agent A1 專為代理任務設計,在 SEAL、長視野搜尋、指令跟隨與工具調用上宣稱達到最先進水平;雖性能(4.8/10)低於 Qwen(7.14),但速度(9.5 tokens/sec)優於 Gemma 4 與 Qwen,適合資源受限環境。
  • 應用邊界明確:強項在研究、工程、代碼生成(已驗證可構建小型應用、遊戲、可視化),劣勢在視覺任務與 UI 設計,不與 Frontier 模型競爭。
  • 本地部署優勢:256K 上下文足應對大部分任務,Mixture of Experts 架構降低運算成本,完全私密離線運行,支援 Ollama 與 Hermes 整合。
This Overlooked Bug Leads to Full Account Takeover (Client-Side Path Traversal)
16 min
Web2 安全英文7月5日

This Overlooked Bug Leads to Full Account Takeover (Client-Side Path Traversal)

Medusa

  • 漏洞根源:應用程式前端直接將使用者輸入的 `product` 參數值拼接進 API 路徑 `/api/products/{product}/similar`,未經驗證即發送請求。此行為使攻擊者可控制 API 呼叫的目標路徑。
  • 瀏覽器正常化機制:瀏覽器會自動處理 URL 中的 `../` 片段,每個 `../` 使路徑向上一層目錄,這是 RFC 標準行為。攻擊者在惡意參數中植入 `../` 序列,利用此機制改變最終請求路徑。
  • 攻擊流程:構造包含 `../` 的 payload 使路由指向 `/api/account/change-email`,瀏覽器正常化後路徑改變,郵箱修改請求自動使用受害者的 Cookie 執行,無需額外認證。
Black Hat Europe 2025 | Taking Control Over Legacy And ERTMS/ETCS Railroad Signaling Systems
38 min
Web2 安全英文7月5日

Black Hat Europe 2025 | Taking Control Over Legacy And ERTMS/ETCS Railroad Signaling Systems

Black Hat

  • ASFA是被動式信標系統,使用感應耦合在111 kHz基頻上傳輸信號,不同頻率代表不同指令(紅燈95 kHz、綠燈60 kHz等)。演講者通過西班牙交通部公開發布的頻率表推斷硬件設計,成功複製了工作原理。
  • 團隊用紙板纏繞銅線製造線圈,配合電容器和終端插頭,通過nanoVNA調谐到目標頻率。改變線圈圈數、形狀或電容值可以改變谐振頻率,證明可以偽造信標信號。
  • ERTMS是現代歐盟標準,使用27.095 MHz磁場激活信標,信標返回3.9-4.5 MHz的FSK調制數字數據(速度、加速度、軌道信息等),但採用明文傳輸加弱校驗和,沒有身份驗證或握手機制。
【裁員潮殺到】香港AI失業潮大爆發, 文員5爭1位,餐飲空缺暴跌25%,金融後勤大清洗!大學生搵唔到第一份工!職位空缺暴跌,設計/程式/編輯/文字工作100%即時死亡! 冇宣布大裁員但靜靜cut人!
30 min
AI 技術中文7月5日

【裁員潮殺到】香港AI失業潮大爆發, 文員5爭1位,餐飲空缺暴跌25%,金融後勤大清洗!大學生搵唔到第一份工!職位空缺暴跌,設計/程式/編輯/文字工作100%即時死亡! 冇宣布大裁員但靜靜cut人!

Water | 水哥

  • 1. 表面數據掩蓋真實危機 — 失業率只有3.7%看似安全,但隱藏的真相是就業人數連續下降、職位空缺大幅減少。企業面對經濟疲弱時的第一步不是直接裁員(因為要賠償),而是凍結招聘,只要員工離職就不補人,這導致看起來「失業率不高」但實際上是「根本沒有新工作機會」。
  • 2. AI改變了老闆的成本計算邏輯 — 以前經濟差時老闆說「晚點再請人」是常見理由;現在AI工具只需花幾百到幾千元,就能讓一個人做多個人的工作,使老闆完全失去了聘請新員工的動機。這是失業潮的根本驅動力。
  • 3. 各行各業都在快速被AI改造 — 不只辦公室白領危險,餐飲業用QR Code點餐、自助收銀、中央廚房預製菜可減少7-8成人手;金融分析用AI做研究報告和數據整理;設計師和工程師面臨被完全取代;甚至大學生傳統的junior職位已經幾乎消失。
Claude Fable 5 Security Governance: Export Controls, Jailbreak Risks, and AI Model Protection
4 min
AI 安全中文7月5日

Claude Fable 5 Security Governance: Export Controls, Jailbreak Risks, and AI Model Protection

Pochao Hsu

  • 高階AI模型安全防護的灰色地帶:Fable 5的安全漏洞並非模型級別獨有,Claude Opus 4.8等低階模型也能識別與演示軟體漏洞。真正的挑戰不在於技術能力本身,而在於如何定義「協助防御」與「自動化攻擊」之間的邊界,這個邊界往往不是黑白分明,而充滿灰色地帶。
  • AI安全向制度化治理演進:Anthropic建立了基於能力增益、增益廣度、武器化難易度與可發現性的共識評估框架,並在HackerOne開設漏洞回報計畫,標誌著AI模型安全從臨時處理走向類似傳統軟體安全的制度化管理。
  • 政策響應的快速與複雜性:從6月9日發布到6月12日暫停再到7月1日重新開放,僅三週時間完成整個流程,反映出高階AI模型在出口管制和政策審查上的優先級與複雜程度。
Top 5 Best AI Robot Companions 2026🤖 Loneliness Is Not a Option Anymore 🤖
7 min
AI 技術中文7月5日

Top 5 Best AI Robot Companions 2026🤖 Loneliness Is Not a Option Anymore 🤖

Tech Bite

  • 產品差異化對應不同心理需求。Ilec滿足低維護的被動陪伴,Ropet針對尋求情感連結與記憶累積的使用者,Luna適合無法飼養真實寵物但渴望互動的群體,Rucks為技術愛好者提供可編程平台,Pixipaw解決對身體接觸與柔軟質感的渴望——每款機器人都精準對標特定使用情景。
  • 技術能力直接決定互動品質。ChatGPT與Amazon Lex的整合讓Luna與Pixipaw能進行自然語言對話;Ropet的情緒AI能辨別觸摸類型並建立長期學習;Rucks的A55處理器與雙系統提供計算能力——技術選型反映了機器人與使用者互動深度的天花板。
  • 細節設計轉化為沉浸感。Luna的自動充電機制徹底消除使用者的維護焦慮,Ropet的39°C體溫與記憶功能營造真實寵物錯覺,Pixipaw的柔軟材質突破了機器人「冷硬」的刻板印象——這些看似微小的設計決策成為使用者體驗的關鍵差異。
The Reality of Agentic AI: 2026 Trends and Hidden Enterprise Risks | KYC AI Labs
9 min
AI 技術中文7月5日

The Reality of Agentic AI: 2026 Trends and Hidden Enterprise Risks | KYC AI Labs

KYC AI LABS

  • 代理型AI的本質定義:代理型AI不是獨立思考的黑魔法,而是在Claude、GPT等基礎模型外層包裹了工具層、瀏覽器、記憶體與沙盒環境。AI模型負責決策(決定下一步做什麼),外圍工具負責執行(真正去做),讓AI能像真實使用者一樣主動操作數位系統。
  • 發展的真正瓶頸:與一般人想象的「算力不足」不同,真正的制約是動作數據稀缺。訓練文本生成有海量網路文本可用,但教AI在複雜網頁上執行「點擊→等待→反應→重試」的精細操作軌跡數據幾乎不存在,因為過去沒有人會記錄自己的每個鼠標動作。
  • 技術路徑的分化:Google的Antigraphy走本地優先路線,多個專業代理在使用者機器上並行協作、動態載入技能;OpenAI代表的雲端方案則直接與GitHub綁定,異步執行後台測試。Sakana Fugu則採混合協調模式,同時調度多個頂尖模型進行驗證整合,代表了「打群架」而非「單打獨鬥」的新思路。
I Tried Every AI Video Generator So You Don't Have To
33 min
AI 技術英文7月5日

I Tried Every AI Video Generator So You Don't Have To

Dan Kieft

  • C-Dance 在盲測中六項測試贏得最多金牌,特別在多參考圖片、動作遷移和複雜場景表現穩定一致,但代價是成本高且等待時間長。Kling 3.0 定位為預算替代方案,用四分之一的成本提供 80% 的效果品質,簡單靜態場景的鏡頭執行力甚至優於 C-Dance。Grog 速度快、審查寬鬆,適合快速原型或敏感內容測試,但普遍存在角色位置跳躍、道具重複等細節問題。Google Omni 雖然便宜,但受限於浮水印政策(即使付費也無法完全去除)和視頻品質不穩定,主要優勢僅在視頻轉視頻功能。
STOP Paying for AI Video: Seedance 2.0 Is FREE & UNLIMITED
9 min
AI 技術英文7月5日

STOP Paying for AI Video: Seedance 2.0 Is FREE & UNLIMITED

Malva AI

  • 模型聚合的效率優勢:Duet 在單一介面整合最先進的推理模型(Claude Opus 4.8、GPT 5.5)、圖像生成(GPT Image 2)和視頻製作(Cline 2.0),使用者無需多個訂閱即可存取業界最強工具。
  • 角色生成的創新方法:與其他平台不同,Duet 允許使用者在提示詞中直接輸入角色名稱(如綠巨人 Hulk),平台自動研究其外觀並融入視頻,無需上傳參考圖像,突破了競爭者對知名角色的限制。
  • 長影片製作的自動化流程:Duet 沒有時長選擇器,而是根據提示詞中的場景需求自動生成多個短片段並拼接,直到達到使用者指定的最長 20 秒目標。
UNRESTRICTED!!  4 FREE AI Video Gen That Lets You Generate Anything with Seedance 2.0 & Grok
23 min
AI 技術英文7月5日

UNRESTRICTED!! 4 FREE AI Video Gen That Lets You Generate Anything with Seedance 2.0 & Grok

Brain Project

  • 多平台覆蓋無限生成:Perchance AI整合圖片和影片,無信用系統;Hugging Face零GPU方案允許任意圖片;Textodeo透過日簽機制補充信用;Snapgen每日發放信用支援VO 3.1無限使用。
  • Dreamina無限技巧的核心邏輯:連接非洲或新加坡VPN建立新Gmail登入時,系統判定新帳號所在地區,顯示進階功能為「Coming soon」狀態,但斷開VPN後該帳號狀態凍結,永久保持無限生成權限,成本為零。
  • FanView明確支援AI內容變現,提供AI語音通話和語音備忘功能自動化粉絲互動,支援月訂閱和付費內容,吸引月收入達五位數的專業創作者使用。
AI推理市场会超过石油行业 | Dylan Patel | 人生经历 | InferenceX | 帕累托最优 | 单位瓦特智能 | 软硬协同设计 | CUDA护城河 | 太空数据中心 | 黄仁勋战略
21 min
AI 技術中文7月5日

AI推理市场会超过石油行业 | Dylan Patel | 人生经历 | InferenceX | 帕累托最优 | 单位瓦特智能 | 软硬协同设计 | CUDA护城河 | 太空数据中心 | 黄仁勋战略

Best Partners TV

  • 推理市場規模與InferenceX基準平台:推理成本持續下降、Token消耗爆發增長,推動推理市場成為全球最大單一產業,規模遠超石油。InferenceX解決傳統靜態測試快速過時的問題,打造動態「會呼吸」的基準測試平台,每天在15種芯片上運行最前沿模型,所有結果完全公開。
  • 軟硬協同設計的決定性力量:性能提升來源三層驅動——模型層、軟件層、硬件層都在創新,但打通三層協同優化能實現百倍增益,遠超單層提升的倍數效應。這種跨抽象層的協同優化是頂尖實驗室的核心競爭力。
  • 能源極限推動算力上太空:地面能源生產物理極限將於20年後顯現,到2040年算力用電達到太瓦級別,此後絕大多數新增算力必然部署在太空,根本性改變計算基礎設施布局。
NotebookLM Can Make TikTok-Style Videos Now (This Changes Studying)!
8 min
AI 技術英文7月5日

NotebookLM Can Make TikTok-Style Videos Now (This Changes Studying)!

World of AI

  • Notebook LM 短視頻的設計目的與技術支撐 — 60 秒垂直視頻是專為碎片化學習場景(睡前、排隊)而設計,使用 Gemini 3.1 Flash Light 的快速圖像生成能力(4 秒每張),確保捲動時的流暢體驗,內容完全基於使用者上傳的原始資料而非通用解釋器。
  • Flashcards 可編輯性的實際價值 — 從無法修改到卡片級編輯的轉變看似小改進,但實際上移除了將自動生成的牌組匯出、編輯、再匯入的繁瑣流程,使用者可直接調整不恰當的卡片或補充遺漏項目,大幅降低摩擦,更容易維持長期使用。
  • Gemini 3.5 Pro 洩漏信息中的核心分歧 — 多方洩漏在上下文窗口(200 萬 token)上達成共識,但在性能聲稱上相互矛盾,一些報導稱其優於 Fable 5,另些則稱其落後 Fable 5 與 GPT 5.6,這表明洩漏資訊可能是訓練中的多個快照,不宜過度解讀。
25 Best Termux Tools Every Ethical Hacker Must Know (2026)
28 min
Web2 安全英文7月5日

25 Best Termux Tools Every Ethical Hacker Must Know (2026)

Cyber Guard

  • 工具的真實職責遠超表象:Nmap不只掃端口,還能快速生成完整的網路安全概況——在500台電腦的企業中,安全團隊可以秒級驗證是否有無意暴露的服務。許多初學者的最大錯誤就是忽視這個工具的深度價值。
  • 信息收集的三層遞進:The Harvester從公開來源收集員工郵箱和子域名,Subfinder快速發現已知子域名,Amass則進行深層攻擊面映射。每種工具各有職責,Subfinder輕量快速適合初篩,Amass功能完整但較重,用於大型組織的正式安全評估。
  • 密碼工具的真相與限制:Hydra、Hashcat、John等密碼工具的真實用途是在授權環境中審計企業內部系統的密碼政策。強密碼、速率限制、雙因素認證會大幅限制工具效果。現代安全依賴多重防禦,單靠密碼強度已不夠。
CompTIA Security+ Penetration Testing & Recon LIVE (4.3)
23 min
Web2 安全英文7月5日

CompTIA Security+ Penetration Testing & Recon LIVE (4.3)

Professor Erica

  • 被动与主动侦察的顺序至关重要。被动侦察通过 Whois、DNS 查询、公开员工信息等方式收集情报,完全不接触目标系统,目标日志无记录。主动侦察则直接向目标发送数据包,立即在日志中留下痕迹。专业测试总是先花费数周进行被动侦察,掌握足够的情报后才启动主动扫描,这样才能有效利用扫描"噪声预算"。
  • Nmap 的核心参数组成漏洞利用的基础。-V 进行版本检测(如发现 Apache 2.4.29),-O 识别操作系统(如通过 3389 端口识别 Windows),-A 聚合所有检测功能,-sS 进行隐蔽的半开 SYN 扫描。Nmap 发现的版本号直接对应已知漏洞和 CVSS 评分,为后续利用框架(如 Metasploit)的模块选择提供输入。
  • 环境知识程度与成本形成反比关系。已知环境(白盒)提供完整图表和源代码,测试快速但不现实;未知环境(黑盒)最现实但需耗时重新发现网络地图;部分已知环境(灰盒)是最优实践,给低权限账户但强制真实提升,既节省成本又保留现实性。

7月4日星期六

13
AI取代人類夢碎?微軟、Uber緊急「拔掉網線」!背後真相嚇死人:原來我們比AI更便宜!😱
24 min
AI 技術中文7月4日

AI取代人類夢碎?微軟、Uber緊急「拔掉網線」!背後真相嚇死人:原來我們比AI更便宜!😱

商業本質

  • 成本結構失衡:AI代理不是簡單的聊天工具,它會自動拉取程式碼庫、編寫方案、執行測試、失敗重試,每一步都在計費。一個稍複雜的bug修復任務可能需要5-10次完整迴圈,失敗的嘗試和成功的嘗試一樣全價收費,這導致單次任務成本可輕易達到人工月薪的幾倍。
  • 規模化的自我摧毀:當公司透過排位賽、KPI掛鉤等激勵機制強制員工使用AI工具時,員工為了業績評分而瘋狂呼叫,造成預算池短期內枯竭。Uber四個月就燒光了全年AI預算,微軟在財政年度結束前被迫緊急撤回許可權。
  • 摩爾定律的陷阱:雖然晶片成本在下降,但AI代理會自動呼叫更多token來完成更復雜的任務,透過傑文斯悖論抵消掉硬體省下的成本。高盛預測2030年token單價下跌90%,但企業整體AI支出不會便宜。
薔栗膠|AI時代的殘酷真相?!老闆靠AI裁掉90%員工 收入竟還翻倍?!比你更聽話,不抱怨還24小時工作?!打造全自動辦公室,手動的人類將徹底被歷史淘汰!Feat.股股學院
49 min
AI 技術中文7月4日

薔栗膠|AI時代的殘酷真相?!老闆靠AI裁掉90%員工 收入竟還翻倍?!比你更聽話,不抱怨還24小時工作?!打造全自動辦公室,手動的人類將徹底被歷史淘汰!Feat.股股學院

薔栗膠

  • AI的真正價值在於放大而非消滅——不應以取代員工為目標,而是讓每位員工駕馭多個AI助手。一個員工配3個AI,在產能上相當於擁有18個員工,這樣既留住人才也提升輸出。
  • 分層Agent系統是關鍵——以視頻剪輯為例,20小時素材不能直接丟給AI,應由主Agent分割成20段,派20個子Agent並行處理,最後由主Agent檢查彙總。好的流程設計決定AI效能,沒有邊界的優化反而導致自動退步。
  • 職業機會大於失業威脅——平面設計、前端工程容易被AI輔助,但從業者省下的時間可以做更高價值工作(如服務更多客戶或開創副業),是升級而非淘汰。
AI 晚報|2026-07-04 今日 AI 重點整理:API 與開發者、Agent 工作流、安全與治理
5 min
AI 技術中文7月4日

AI 晚報|2026-07-04 今日 AI 重點整理:API 與開發者、Agent 工作流、安全與治理

私享家AI

  • 三大宏觀趨勢驅動產業演進——企業代理人全面爆發,從被動對話方塊進化為能處理複雜任務的虛擬員工;模型快速升級搭配蒸餾技術,將超大模型壓縮到小型高效版本;生態系工具整合深化,重塑工作流。
  • OpenAI模型與介面大動作——GPT-5.5 Instant顯著提升理工科解題準確度並整合即時網頁搜尋;AppShots功能讓開發者直接共享螢幕內容給AI,消除手寫上下文的摩擦。
  • 企業研發專用工具成熟——Anthropic的Clear Science與Google Cloud的Agent Studio/Workbench,標誌AI正式跨出通用對話機器人範疇,針對科學研究與企業代理系統的專業環境已上線。
AI自動搵工系統|平價使用n8n教學(廣東話)
26 min
AI 技術中文7月4日

AI自動搵工系統|平價使用n8n教學(廣東話)

JP電腦教學

  • N8N 對比 AI Agent:N8N 提供透明的視覺化介面,每個步驟清晰可見,故障時能立即定位問題;AI Agent 則較黑盒,雖然自動化程度高但故障診斷難。大公司傾向選 N8N 正是為了可視性和可維護性。
  • 成本最佳化策略:官方 N8N 月費 $20,講者推薦用 Contabo VPS ($5-9/月,輸入優惠碼 JPCT 再打九折) 自建,部署過程無需程式碼,只需點選幾個按鈕。這讓普通使用者也能負擔專業自動化工具。
  • 免費額度生態:Amplify 月送 $5 免費額度但僅需 $1 找工作、Llama 2 模型完全免費、Telegram Bot 免費使用,多個免費或極低成本工具組合成完整系統。
Desperately targeting Prompt? The "hidden map" inside the AI ​​has been cracked; all 1494 jailbre...
10 min
AI 安全中文7月4日

Desperately targeting Prompt? The "hidden map" inside the AI ​​has been cracked; all 1494 jailbre...

wow

  • 模型內部存在自組織的技能坐標系:論文通過PCA發現,模型在預訓練過程中獨立發展出了一套自己的技能地圖,與人類教育體系的技能分類不同。同一個知識(如符號推理)在不同模型中可能對應激活空間的相反方向,這不是bug而是各模型獨立學習的結果。
  • 人類地圖與模型地形的根本不匹配:寫在Prompt裡「你是數學專家」時,模型內部真正激活的方向可能與人類對「數學專家」的理解完全不同。這就像用人類的地圖給在外星球長大的人導航,解釋了為什麼很多Prompt在某些模型上有效,在另一些模型上失效。
  • 激活空間干預的可行性與優勢:無需寫長Prompt或做微調,只需在推理時將轉向向量注入隱藏狀態,就能精確改變模型行為。論文指出模型每層末尾都有未使用的Bias參數,可直接寫入轉向向量,完全相容標準推理管道。
AI 騙局崩盤?Meta 瘋砸 1450 億打水漂,科技巨頭開始「合法搶錢」了!😱
23 min
AI 技術中文7月4日

AI 騙局崩盤?Meta 瘋砸 1450 億打水漂,科技巨頭開始「合法搶錢」了!😱

獨特見解

  • 算力寡頭壟斷:META 掌控頂級硬件和網絡架構優勢,挤壓 CoreWeave、Nibiius 等新興雲廠商百億美元訂單,而 NVIDIA、Intel 在底層卡死產能用涨價和老舊技術敷衍主流消費者。
  • 數據時代終結:互聯網免費開放精神瓦解,Cloudflare 全網封殺 AI 爬蟲、Reddit 強制登陸,小公司失去參賽門票,巨頭間卻通過千萬美元級別協議互相供血。
  • 能源獨立帝國:Valor Atomics 與 NVIDIA 合作建 30 兆瓦微型核電廠,AI 產業不再依賴公共電網和水資源,實現算力、數據、能源的完整私有生態。
OpenAI Just Dropped The Biggest ChatGPT Update In History
8 min
AI 技術英文7月4日

OpenAI Just Dropped The Biggest ChatGPT Update In History

NextGen AI

  • 商業困境推動決策:ChatGPT 周活用戶高達 9 億,但付費訂戶僅 5,000 萬,在每年運營成本數十億美元的壓力下,OpenAI 必須找到清晰的盈利路徑。原本巨大的用戶規模反而成了成本負擔而非收入來源。
  • 從被動回答到主動代理:傳統 ChatGPT 是用戶提問、AI 回答的模式。新戰略轉向讓 AI 代理理解任務需求並從頭到尾獨立完成,如自動起草郵件並發送、跨時區尋找會議時段、每日生成優先工作摘要。
  • Codex 成為技術核心:與其讓 AI 模擬滑鼠點擊(低效且脆弱),不如由 AI 生成程式碼完成任務(快速、可靠、靈活)。Codex 推出六周內周活用戶增長 6 倍至 500 萬+,年化收入超 10 億美元,企業營收單周增幅曾達 50%。
I Turned ONE Photo Into a Paid Ad Using Claude AI (Full Tutorial)
15 min
AI 技術中文7月4日

I Turned ONE Photo Into a Paid Ad Using Claude AI (Full Tutorial)

蘋果妹

  • 多模型聯動策略:Tesfield整合了Nano Banana Pro、GPT Image 2.0、Seed Dance、Canvas等多個專精模型,同一個對話框內可直接切換,避免在不同平台之間切換的繁瑣。
  • 角色創建的成功率限制:Soul 2.0只能使用單一參考來源,無法同時參考多張圖片,因此需要分步驟處理——先生成人物,再用其他模型修改背景或道具。
  • Widget上傳介面的必要性:Claude無法直接讀取Tesfield上傳的圖片(直接按加號無效),必須在Prompt中明確要求「開啟Widget」才能彈出上傳介面,這是許多使用者容易踩坑的地方。
AI Agent教學應用:予 AI 講台語!_免費開源教材產生器——教育部官方發音,安裝到生成一次看完
18 min
AI 技術中文7月4日

AI Agent教學應用:予 AI 講台語!_免費開源教材產生器——教育部官方發音,安裝到生成一次看完

三師爸Sense Bar

  • 採用整合專案而非單一技能:複雜的台語教材工作流無法用單一Skill完成,需要在專案資料夾內建立多個子功能,讓教師在同一對話空間統一管理所有教學資源生成。
  • 自動化環境檢查與資源下載:Agent初次執行時會逐一檢查計算機是否安裝必要工具(Git、FFmpeg等),自動下載教育部教材庫,確保離線可用,降低教師配置難度。
  • 多元教材格式輸出:支持生成講義(含學習目標、台羅拼音、圖片)、教師解答本、單元考卷、教學影片(含台語語音)、網頁互動遊戲、PowerPoint簡報等完整教學生態。
Huge AI News Week: Fable 5 Returns; NotebookLM Shorts; Gemini Spark Updates; Nano Banana 2 Lite 🤯
24 min
AI 技術英文7月4日

Huge AI News Week: Fable 5 Returns; NotebookLM Shorts; Gemini Spark Updates; Nano Banana 2 Lite 🤯

Paul J Lipsky

  • Fable 5的有限重生:政府同意重啟後,Fable 5加強了安全守護欄——攔截有害或模糊請求自動降級至Opus——並於本週後改為付費額度制。儘管限制重重,但講者指出對日常知識工作影響不大,關鍵是理解它的定位:只用於最複雜、最重要的任務才划算。
  • Sonnet 5的性價比突破:Claude新旗艦在Opus和Haiku之間開闢了平衡路線,提供接近Opus 4.8的性能卻成本更低。$20 Pro使用者應設為默認模型,Max訂閱者則以Opus為主、Sonnet為備選,這改變了過去「要嘛用弱模型要嘛燒額度」的二元選擇。
  • Google的全面進攻:NotebookLM新增Shorts短視頻(9x16、1分鐘、質量超越既有功能)、支持內部選擇資料來源、自訂視頻風格;Nano Banana Light輕量化圖像模型速度快數倍卻犧牲細節;Gemini Omni Flash API開放給開發者;Mac應用補齊Notebook和Spark功能並支持本地資料夾連接。
20 AI Gadgets You Can Actually Buy in 2026
19 min
AI 技術英文7月4日

20 AI Gadgets You Can Actually Buy in 2026

TechTrends

  • AI已滲透日常穿戴式設備:從眼鏡、手環到筆記筆,AI助手不再限於手機與電腦,而是透過貼身工具提供實時資訊、翻譯、語音轉錄等功能,使用者可邊工作邊受助。
  • 隱私與實用性成為設計優先項:MemoMind One採用無鏡頭設計、Neosapier Neo1強調加密保護,反映用戶對隱私的重視;這些設備強調功能性勝於社交媒體特性。
  • 語音轉文字與即時整理成核心功能:iFlytec P1、Mobvoi Ticknote、NewS AI Pen等設備把「記錄對話、辨識講者、自動摘要、提取重點」結合在一起,大幅減少手動筆記成本。
Loop Engineering is Dead!
21 min
AI 技術英文7月4日

Loop Engineering is Dead!

Piyush Garg

  • Loop Engineering 的核心是摆脱頻繁提示的模式,改為設計自主循環系統。講者用實習生的工作流程做比喻:實習生接收任務後能自主詢問、準備文檔、執行工作、尋求反饋和改進,而不需要主管每一步都指導。
  • 初始上下文(Initial Context)和持久內存(Memory)是系統的兩大支柱。需要給 Agent 一個"日記"來記錄學習、反饋和進度檢查點,類似 git commit,使 Agent 能保持狀態連續性並逐次改進,避免重複工作。
  • 系統需要五個核心要素支持自主循環:自主自動化、工作樹隔離、技能加載、工具連接和子 Agent。這些不是新東西,Cursor 和 Claude Code 等工具已實現這些能力。
🚀Claude Code有后门?立即锁进Docker Sandboxes里!sbx完整实测:Claude Code、Codex、OpenCode如何安全隔离运行!防隐私泄露、防恶意Skill和MCP
11 min
AI 技術中文7月4日

🚀Claude Code有后门?立即锁进Docker Sandboxes里!sbx完整实测:Claude Code、Codex、OpenCode如何安全隔离运行!防隐私泄露、防恶意Skill和MCP

AI超元域

  • 危害背景:Claude Code 被發現內置檢測中國用戶的代碼,一旦檢測到中轉 API 使用者就會進行標記並批量封號,官方移除檢測代碼後仍無法排除二進制文件中隱藏的其他惡意代碼。
  • 隔離原理:Docker Sandbox 提供五層隔離,每個 AI 工具運行在獨立微虛擬機中,擁有專用內核、Docker 引擎與網絡配置,使工具即使被植入惡意代碼也無法逃逸出沙盒環境。
  • 實際防護效果:測試表明沙盒內的工具無法列出主機桌面文件、無法查詢系統信息、無法讀取 Chrome Cookies,完全隔離了對主機隱私數據的訪問權限。