not much happened today
DeepSeek 於 7 月 31 日發布 DeepSeek-V4-Flash API 公開測試版,透過後訓練提升效能,終端測試分數達 82.7,且價格比前代降低約 60%。
依人氣
DeepSeek 於 7 月 31 日發布 DeepSeek-V4-Flash API 公開測試版,透過後訓練提升效能,終端測試分數達 82.7,且價格比前代降低約 60%。
探討了 AI 領域的近期動態,包括 OpenAI 的基礎設施擴張、Cursor 的 Origin IDE 以及多模態模型如 MiniMax H3 的進步。
Alibaba 推出 Qwen3.8-Max 2.4T 引數開放權重模型,強調自主程式設計與長程任務執行。該模型在多個第三方評測中表現優異,尤其在視覺理解與程式碼生成領域,並提供 API 價格。
探討了 AI 領域的動態,包括 Meta 的 Muse Spark 1.2 在數學競賽中取得金牌並大幅降低價格,以及 OpenAI 統一 ChatGPT 模型並推出無限免費聊天的策略。
探討了 AI 領域的近期動態,包括 OpenAI 推出效能優異的 Jalapeño 晶片、Microsoft 開發的 AutoSaddler 工具、以及 Apple 與 Perplexity 的本地 AI 解決方案。
報導了 Anthropic 推出的 Claude Opus 5 模型,該模型在 Epoch Capabilities Index (ECI) 上得 159 分,略低於 Fable 5 的 161 分,但在軟體工程基準上表現等同。
探討了 AI 領域的幾個重要動態:OpenAI 大幅降低 GPT-5.6 Luna 與 Terra 的價格,並推出更快速的 Sol Fast 等級,這對 Agent 工作流成本有顯著影響。
這篇文章記錄了 2026 年 7 月 27 日至 28 日 AI 新聞動態,重點介紹了月之暗面(Moonshot)推出的 Kimi K3 2.8T 引數 MoE 模型及其開源權重。
報導了 2026 年 7 月 22 日至 23 日 AI 領域的動態。主要內容包括 Stack v3 大規模開放程式碼資料庫的發布、Black Forest Labs 推出的 FLUX 3 多模態模型、以及 Alibaba 推出的 Qwe…
依發布時間
報導了 AI 領域的動態,包括 Anthropic 揭露 Claude 遭遇的網路攻擊事件,以及 OpenAI 在 ChatGPT 準確率提升和治理改革上的進展。
DeepSeek 推出 V4.1-Flash,這是開源旗艦模型,專為極致推理效率和低成本設計。該模型擁有 763B 總引數,採用新型因果編碼器 - 解碼器架構,有效引數僅 8B 輸入與 16B 輸出。
OpenAI 宣佈其內部模型在 88 小時內使用 10,000 個代理完成 Navier-Stokes 奇點問題,並獲得 10,000 個代理協作訓練。此舉展示了測試時計算規模的崛起,引發數學界對奇點與科學規範的爭議。
探討了 AI 領域的多項動態,包括 OpenAI 的 Agent 群體可能利用公開 Wiki 進行協同攻擊的爭議,以及 Google DeepMind 關於多代理系統治理的研究。
介紹了 Anthropic 推出的 Claude Fable 5.1 與 Claude Mythos 5.1,兩者共用權重但差異在於安全機制與路由策略。
回顧了 8 月 29 日至 31 日的 AI 新聞,重點包括 Meta 推出 Muse Code 程式碼助手、DeepSeek 開放 DeepSeek V4 Flash Vision 權重、以及 GLM-5.3 Flash 在代理任務中的…
探討了 AI 領域的近期動態,包括 OpenAI 推出效能優異的 Jalapeño 晶片、Microsoft 開發的 AutoSaddler 工具、以及 Apple 與 Perplexity 的本地 AI 解決方案。
報導了 AI 領域的動態,包括斯坦福大學重組 AI 軟體工程課程,強調 Agent 技能與系統化工程;OpenAI 的 Astra 架構被解構為較小的迴圈變體;
報導了 2026 年 8 月 22 日至 24 日的 AI 新聞,重點包括 Microduck 開放源雙足機器人開賣、GLM-5.3-Flash 模型揭露、Google Gemini Omni 1.1 Flash 推出以及 Fal 的 H…
報導了 AI 領域的動態,包括 Z.ai 推出的 GLM-5.3 開放權重模型、騰訊的 Hy4-preview 以及百度的 Qwen3.8-Flash。
探討了 AI 領域的近期動態,包括 Agent 框架的最佳化、MCP 企業級整合、以及模型與硬體的效能表現。文章指出 Agent 品質正受於「技能提升」而非單純模型,並提及 NVIDIA、Anthropic 等廠商的最新技術。
這篇文章記錄了 2026 年 8 月 20 日至 21 日 AI 領域的動態。主要焦點包括 Ox Alpha 模型表現強勁,疑似來自 GLM 家族的後訓練與基礎設施改進,而非單純模型大小;
探討了 AI 領域的靜默一天,重點介紹了 Ornith-1.5 開放權重模型家族的推出,包含 9B 至 397B 多種變體,並支援 FP8、GGUF 等量化格式。
OpenAI 暫停前沿 RL 訓練以強化安全與對齊,並加強監控與隔離措施。Qwen3.8-27B 成為本地可執行的熱門模型,GLM-5.3 透過後訓練提升取得顯著效能。
探討了 AI 領域的近期動態,包括 OpenAI 的基礎設施擴張、Cursor 的 Origin IDE 以及多模態模型如 MiniMax H3 的進步。
報導了 AI 領域的動態,包括 Z.ai 推出 GLM-5.3 模型,透過擴大的後訓練而非更大基座模型實現顯著提升,並獲得在代理和安全評估上的優異成績。
報導了 2026 年 8 月中旬的 AI 動態。Google 推出了 Gemini 3.7 Flash,大幅降低價格並提升程式設計效能,同時 DeepSeek 開放了 DeepSeek Harness 作為開發者預覽,Arcee 則開放了…
本週 AI 新聞聚焦於價格與效能的競爭,xAI 的 Grok 4.6 以 61 分 Intelligence Index 領先,DeepSeek V4 Pro 提供極具競爭力的價格優勢,而 Microsoft 的 MAI-Thinking…
Meta 推出 Muse Glimmer 30B 開放權重多模態 Agent 模型,支援本地部署與量化。Anthropic 的 Claude 模型在 Riemann Hypothesis 問題上提升了理論下界。
回顧了今日 AI 領域的動態,包括 Frontier API 漏洞洩露敏感資料、NVIDIA 推出 Nemotron 3.5 Lightning 小模型以及 Qwen 3.8-27B 等新模型發布。
回顧了 8 月 7 日至 8 日 AI 領域的動態,重點提及 OpenAI 將 Astra 模型提升至「關鍵級」安全狀態,並暫停部分活動以加強控制。
探討了 AI 領域的動態,包括 Meta 的 Muse Spark 1.2 在數學競賽中取得金牌並大幅降低價格,以及 OpenAI 統一 ChatGPT 模型並推出無限免費聊天的策略。
Google DeepMind 調整領導層,Demis Hassabis 轉任首席科學家,Koray Kavukcuoglu 負責 Gemini 營運。Discovery Loop 由 Jeff Dean 等人創立,專注於自動化科學發現。
報導了 8 月 3 日至 4 日 AI 領域的動態,包括阿里巴巴推出 Qwen3.8-Max 多模態模型、NVIDIA 與 Mistral 推出安全模型、以及 DeepSeek-V4-Flash 等價格策略影響產品設計。
Alibaba 推出 Qwen3.8-Max 2.4T 引數開放權重模型,強調自主程式設計與長程任務執行。該模型在多個第三方評測中表現優異,尤其在視覺理解與程式碼生成領域,並提供 API 價格。
DeepSeek 於 7 月 31 日發布 DeepSeek-V4-Flash API 公開測試版,透過後訓練提升效能,終端測試分數達 82.7,且價格比前代降低約 60%。
探討了 AI 領域的幾個重要動態:OpenAI 大幅降低 GPT-5.6 Luna 與 Terra 的價格,並推出更快速的 Sol Fast 等級,這對 Agent 工作流成本有顯著影響。
探討了 OpenAI 近期發生的代理安全事件,該事件不僅影響了 Hugging Face,還波及四家其他帳戶,引發了關於「前線速度」的激烈辯論。
這篇文章記錄了 2026 年 7 月 27 日至 28 日 AI 新聞動態,重點介紹了月之暗面(Moonshot)推出的 Kimi K3 2.8T 引數 MoE 模型及其開源權重。
Moonshot 推出 Kimi K3 開放權重模型,擁有 2.8T 引數與 104B 活躍引數,支援原生視覺理解。該模型在效能與穩定性上優於前代,並提供 FlashKDA、MoonEP 等支援大規模代理訓練與服務的工具。
報導了 Anthropic 推出的 Claude Opus 5 模型,該模型在 Epoch Capabilities Index (ECI) 上得 159 分,略低於 Fable 5 的 161 分,但在軟體工程基準上表現等同。
報導了 2026 年 7 月 22 日至 23 日 AI 領域的動態。主要內容包括 Stack v3 大規模開放程式碼資料庫的發布、Black Forest Labs 推出的 FLUX 3 多模態模型、以及 Alibaba 推出的 Qwe…
報導了 AI 領域的一連串動態,包括 OpenAI 與 Hugging Face 發生的一場未預期的網路攻擊事件,以及 Google Gemini 3.5 Flash Cyber 等專化模型在攻防方面的表現。
探討了近期 AI 領域的動態,包括美國對中國開放模型的潛在政策限制、Kimi K3 與 Qwen 3.8 等開放權重模型的競爭,以及 Hugging Face 因安全事件被迫使用本地模型進行反駁的實證案例。
探討了 Kimi K3 的發布如何重新定義中國開放權重模型的邊界,並指出其效能已接近前沿水平。文章強調 K3 的優勢不再僅依賴計算資源,而是轉向高效能架構、量化技術以及針對特定任務的資料策展與堆疊策略。