跳到主要內容
AI 武林
影片進階中文1,406 次觀看

o3、o4 mini high数学和推理能力评测

來源 马克的技术工作坊

看影片(在新分頁開啟原站)連到 马克的技术工作坊

摘要

測試 o3、o4 mini high 與 Gemini 2.5 Pro 在數學推理與程式任務上的表現。觀眾可比較不同模型處理複雜邏輯與編寫程式的能力差異。

This video benchmarks o3, o4 mini high, and Gemini 2.5 Pro on math reasoning and coding tasks.

這筆內容還沒有取得字幕或內文,這段摘要只根據標題與說明欄產生,可能不夠準確;實際內容請以原站為準。

章節

取自原站說明欄的時間軸

  1. 00:00前言
  2. 01:54算法评测
  3. 03:34Gemini 2.5 Pro 做 markdown 转思维导图
  4. 08:53o3 做 markdown 转思维导图
  5. 13:48o4-mini-high 做 markdown 转思维导图
  6. 16:19Gemini 2.5 Pro 做 Flappy Bird
  7. 17:07o3 做 Flappy Bird
  8. 17:27o4-mini-high 做 Flappy Bird
  9. 17:54Gemini 2.5 Pro 玩 Flappy Bird
  10. 19:43o3 玩 Flappy Bird
  11. 20:32o4-mini-high 玩 Flappy Bird
  12. 22:23总结

提到的工具與公司

  • o3
  • o4-mini-high
  • Gemini 2.5 Pro

適合誰看

正在評估或比較大語言模型效能的開發者與技術人員。

摘要依據

依據
標題與說明欄(還沒有取得字幕或內文)

為什麼排在這裡

人氣
0.22
新鮮
0.13

在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算

摘要由 AI 根據標題與說明欄產生(還沒有取得原文),可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)