Nano Banana can be prompt engineered for extremely nuanced AI image generation
深入測試 Google 推出的 Nano Banana(Gemini 2.5 Flash Image)模型,透過複雜提示詞驗證其精準度與提示工程能力。
部落格 ・ 國際 ・ 英文 ・ A 級 ・ 8 筆內容 ・ 最近更新 2026/09/22
用實驗驗證 LLM 與 coding agent 的說法(讓 agent 寫出比現有函式庫快的 Rust、模型怪癖實測);一兩個月一篇、每篇都附資料
依人氣
深入測試 Google 推出的 Nano Banana(Gemini 2.5 Flash Image)模型,透過複雜提示詞驗證其精準度與提示工程能力。
記錄 AI 研究人員發現一個數學猜想反例後,測試多個大型語言模型對該反例的反應。文章展示了不同模型在面對邏輯悖論時的各種有趣回應,從興奮確認到懷疑論,甚至出現「精神失常」的幽默情境,探討了 AI 在處理複雜數學問題時的侷限與行為。
作者透過讓 AI 代理反覆最佳化 Rust 程式碼,將 UMAP 等演算法速度提升數倍至數十倍。文章分享具體的提示工程技巧、基準測試設定與子代理策略,並說明為何選擇 Rust 與 PyO3 結合。
分析 OpenRouter 排行榜上突然走紅的 Hy3 模型,指出其實際效能與價格優勢並不明顯。作者透過資料發現,考慮到快取機制後,DeepSeek V4 Flash 的有效價格遠低於 Hy3,質疑 Hy3 的熱門是單一大型應用驅動。
作者觀察到 OpenAI 與 Anthropic 近期頻繁重置 Codex 的每週使用額度,並分析這可能是為了防止使用者在強勁新模型推出前測試競爭對手。
作者以懷疑態度測試最新 AI 編碼代理 Opus 4.5,透過實際開發 Rust 套件與資料科學專案驗證其能力。文章分享如何撰寫 AGENTS.md 規範指令、使用特定工具鏈提升程式碼品質,並探討 AI 對開發者技能與職業生涯的真實影響。
深入測試 Google 最新推出的 Nano Banana Pro,比較其與基礎版在提示遵循、程式碼生成、文字排版及風格轉移上的差異。
作者測試多個大型語言模型對越獄提示的反應,發現 Claude Haiku 4.5 不僅拒絕生成色情內容,還會以個人化且帶有情緒的方式回應試圖越獄的使用者。
依發布時間
作者透過讓 AI 代理反覆最佳化 Rust 程式碼,將 UMAP 等演算法速度提升數倍至數十倍。文章分享具體的提示工程技巧、基準測試設定與子代理策略,並說明為何選擇 Rust 與 PyO3 結合。
記錄 AI 研究人員發現一個數學猜想反例後,測試多個大型語言模型對該反例的反應。文章展示了不同模型在面對邏輯悖論時的各種有趣回應,從興奮確認到懷疑論,甚至出現「精神失常」的幽默情境,探討了 AI 在處理複雜數學問題時的侷限與行為。
作者觀察到 OpenAI 與 Anthropic 近期頻繁重置 Codex 的每週使用額度,並分析這可能是為了防止使用者在強勁新模型推出前測試競爭對手。
分析 OpenRouter 排行榜上突然走紅的 Hy3 模型,指出其實際效能與價格優勢並不明顯。作者透過資料發現,考慮到快取機制後,DeepSeek V4 Flash 的有效價格遠低於 Hy3,質疑 Hy3 的熱門是單一大型應用驅動。
作者以懷疑態度測試最新 AI 編碼代理 Opus 4.5,透過實際開發 Rust 套件與資料科學專案驗證其能力。文章分享如何撰寫 AGENTS.md 規範指令、使用特定工具鏈提升程式碼品質,並探討 AI 對開發者技能與職業生涯的真實影響。
深入測試 Google 最新推出的 Nano Banana Pro,比較其與基礎版在提示遵循、程式碼生成、文字排版及風格轉移上的差異。
深入測試 Google 推出的 Nano Banana(Gemini 2.5 Flash Image)模型,透過複雜提示詞驗證其精準度與提示工程能力。
作者測試多個大型語言模型對越獄提示的反應,發現 Claude Haiku 4.5 不僅拒絕生成色情內容,還會以個人化且帶有情緒的方式回應試圖越獄的使用者。