一龍馬/AI 情報站讀懂消息背後的脈絡
星期四
搜尋

主題時間線 · 人物

Ethan Mollick

跨來源、跨日期追蹤 Ethan Mollick 的公開情報與主編判讀。

近一年收錄 147 則不同情報

統計範圍與相關主題

近 7 天已收錄 14 則不同情報。比較資料不足:本期完整涵蓋 0/7 天,前期 0/7 天。

所有數字皆以來源網址或貼文識別碼去重;重複出現在不同日期的相同情報只算一則。

近一年不同情報
147
近一年每日收錄次數
152
收錄期間
2026-08-27至 2026-10-08
歷史關鍵字搜尋:147 筆去重結果(不限本期)第 5/8 頁
為什麼與主題統計筆數不同?

主題統計比對原始資料與中文判讀中的主題別名;下方搜尋另含原文節錄,並搜尋全部可用歷史。比對文字及日期範圍不同,筆數可能不同。

星期六

X AI 快報#27取得全文

Ethan Mollick 認為,一段關於費馬最後定理的證明說明即使很短,仍帶有明顯的 Claude 文風,尤其是「逐步命名並指出承載該步驟的 Lean 定理」這種表述

Ethan Mollick @emollick

這只是他對文字風格的主觀判斷,貼文未附完整內容,也不能據此確認作者模型或證明是否正確。

一龍馬判讀模型生成內容可能留下可辨識的寫作慣例,但風格辨識不能取代來源追溯,更不能作為數學正確性的證據。

比對原文節錄
It is funny that the Fermat's Last Theorem proof description, short as it is, still smells so much of Claude ("names eac…
X AI 快報#32取得全文

Ethan Mollick 表示,他把一個開放、單一檔案的海面風暴生成器交給「GPT-6 Astra」,要求模型補完其餘海洋環境,並加入動物行為的程序化模擬

Ethan Mollick @emollick

他提供可直接遊玩的網站與 GitHub 原始碼連結。現有證據未包含儲存庫 README、提示詞、修改紀錄或測試資料,因此無法判斷模型實際貢獻、程式架構與專案成熟度。

一龍馬判讀這類案例呈現生成式 AI 快速擴充互動原型的可能性,但單一展示不能證明模型能穩定產出可維護、可上線的軟體。

比對原文節錄
I gave GPT-6 Astra this very cool open single file ocean surface storm generator and asked it to create the rest of the…
X AI 快報#39取得全文

Ethan Mollick 解釋,他在新模型推出時大量發布視覺內容,是因為他認為讀者很少點擊連結,而圖像較容易傳達 AI 進展

Ethan Mollick @emollick

想看深入內容的讀者則可前往賓州大學華頓商學院 Generative AI Labs 的研究與洞察頁面;貼文沒有提出點擊行為資料或特定研究結論。

一龍馬判讀這凸顯 AI 傳播在易讀視覺與完整研究證據之間的落差,讀者不應把吸睛示例直接當成能力評測。

比對原文節錄
I occasionally get asked why I post so many visual things when new models come out.
X AI 快報#41取得全文

Ethan Mollick 分享,面對一個定義模糊的 Blender 交付要求,Astra 會自行啟動歷史研究、視覺評論等代理並直接展開工作

Ethan Mollick @emollick

他認為 Astra 與 Fable 的特點也是難題:它們不只是回答問題,而會主動拆解任務、採取行動。這是個人使用觀察,貼文未提供成果品質、耗時或可重現測試。

一龍馬判讀代理愈能自主執行,使用者就愈需要事先界定權限、驗收標準與停止條件;否則快速行動也可能放大方向錯誤與資源浪費。

比對原文節錄
One thing that makes Astra (and Fable) so interesting and, in some ways, so hard to grapple with is that they just take…
X AI 快報#46取得全文

Ethan Mollick 主張,面對 Fable、Astra 這類模型,較合適的心智模型是把工作委派給一支能力不錯的外部團隊,而不是交代實習生

Ethan Mollick @emollick

使用者應說清楚目標、AI 可自行決定的範圍、需要測試的事項、何時回報求助,以及何謂合格成果。這是操作框架與個人判斷,貼文沒有提供實驗資料證明其成效。

一龍馬判讀人機協作的瓶頸可能從逐步下指令轉向治理委派:管理者必須建立權限、檢核點與驗收規格,避免自主代理在錯誤方向上持續執行。

比對原文節錄
The mental model for Fable and Astra class models is that you are delegating to a good outside team, not an intern.
X AI 快報#59取得全文

Ethan Mollick 展示一個自稱由「GPT-6 Astra」最高設定產生的 twigl.app shader,提示要求打造被暴風海浪局部淹沒、具有新哥德式高塔的無限城市

Ethan Mollick @emollick

他隨後只追加「Make it better」,並分享可開啟成果的連結。這是單一公開示範,貼文沒有提供生成過程、比較基準或可重現測試,因此不足以驗證模型整體能力。

一龍馬判讀案例呈現模型以自然語言迭代視覺程式碼的可能性,對創意程式開發與快速原型製作有直接意義;但不能由單一精選成果推論可靠度或相較其他模型的優勢。

比對原文節錄
Since people were asking, here's GPT-6 Astra, highest setting: "create a visually interesting shader that can run in twi…
X AI 快報#76取得全文

Ethan Mollick 表示,AI 能在每篇不到數小時內產出他認為準確、沒有 p-hacking 的原創研究論文,令他驚訝;但成果雖非粗製濫造,選題卻不有趣

Ethan Mollick @emollick

他據此判斷,即使透過提示詞引導,AI 仍很難具備研究品味。來源未附論文、驗證方法或同儕審查結果,因此「準確」與「沒有 p-hacking」仍是他的個人評估。

一龍馬判讀研究自動化可能大幅壓縮執行與寫作時間,但選題價值、問題意識和判斷力仍可能成為瓶頸。研究人員不能只以格式完整或技術正確取代人工審題與外部驗證。

比對原文節錄
R to @emollick: On one hand, it is absolutely amazing that I could get accurate, non-p-hacked original research papers i…
X AI 快報#77取得全文

Mollick 描述 Astra 的一次失敗測試:他要求系統利用可找到的線上資料集進行原創創業研究,並預先登錄假設

Ethan Mollick @emollick

Astra 產出大量排版精美、技術上正確的論文,但題目乏味,因此他認為系統缺乏研究品味。貼文沒有提供論文內容、資料集或評分標準,無法獨立檢驗其技術正確性。

一龍馬判讀Astra 的案例區分了「完成研究流程」與「提出有價值問題」兩種能力,後者仍需研究者主導。若機構以產量或外觀衡量成果,可能放大低價值研究並浪費審查資源。

比對原文節錄
An interesting failure of Astra: I asked it to conduct original entrepreneurship research with whatever online datasets…
X AI 快報#79取得全文

Mollick 說,他也會發布視覺化與娛樂性內容,原因是創作和分享本身就很有趣

Ethan Mollick @emollick

這則回覆未保留前文,因此無法判斷他是在回應哪種內容策略或外界質疑。

一龍馬判讀貼文反映創作者使用 AI 不只追求生產力,也包含探索與表達;但它沒有提出可泛化的產品或研究結論。

比對原文節錄
R to @emollick: (I also post visual and fun stuff because creating things is fun and sharing things is fun)
X AI 快報#80取得全文

Mollick 表示,「同一件事」也適用於 Fable,未來開放權重模型達到 Fable 或 Astra 的水準時亦然

Ethan Mollick @emollick

由於來源缺少前文,「同一件事」究竟指能力、使用方式、風險或其他判斷並不清楚;貼文也沒有說明衡量兩套系統水準的標準。

一龍馬判讀這段話提出商用系統能力可能下放至開放權重模型的方向性判斷,但脈絡不足,不能據此比較模型或預測時程。開放權重若達到相近能力,部署彈性與治理風險都可能改變,仍需具體測試佐證。

比對原文節錄
R to @emollick: The same thing applies to Fable, and will apply to open weights models when they get to Fable/Astra leve…

星期五

X AI 快報#02取得全文

Ethan Mollick 稱,他讓 GPT-6 讀取數萬封電子郵件、文章與行事曆資料,模型自行下載軟體、規劃流程,並連續運作五天建成數 GB 的個人知識 Wiki

Ethan Mollick @emollick

系統目前每天兩次比對新郵件與知識庫,整理待辦、聯絡關係及可能感興趣的資訊;這是個人案例,沒有獨立效能評估。Mollick 明言此做法需開放電腦權限、存在安全風險,而建置期間未計費,因此無法提供實際成本,只推測費用可能相當高。

一龍馬判讀長時間自主執行讓模型從聊天工具轉為個人資訊管理者,但電子郵件與行事曆包含高度敏感資料,權限控管、誤操作、資料外洩及不可預期成本都會限制一般使用者與企業採用。

比對原文節錄
An example of useful knowledge work: I assigned GPT-6 to read through tens of thousands of my emails, my writings, my ca…
X AI 快報#20取得全文

Ethan Mollick 諷刺 AI 公司一邊把模型命名為「mythos」,另一邊用「群星即將就位」預告產品,語氣讓他聯想到 1920 年代恐怖文學

Ethan Mollick @emollick

這是針對產業行銷風格的文化評論,貼文沒有點名公司,也未提出模型能力或產品資訊。

一龍馬判讀當 AI 品牌以神祕、末日式語彙營造聲勢,可能放大炒作並模糊可驗證的產品差異;讀者不應把這則評論當成發布消息。

比對原文節錄
Between one AI company naming their model mythos and another just posting "the stars are almost aligned," I feel like th…
X AI 快報#24取得全文

Ethan Mollick 表示自己曾提前使用 GPT-6,並稱它能連續數天自主替他完成複雜且有意義的工作

Ethan Mollick @emollick

他附上一個由模型製作、以歷史為基礎的亞歷山卓圖書館模擬網站作為較輕量的例子,但詳細文章尚未發布,現階段只有個人使用心得,缺少任務紀錄、人工介入程度與可重現評測。

一龍馬判讀長時間自主執行若可被獨立驗證,會提高代理承接專案級工作的可行性;目前仍不能從單一展示推論其可靠度、史實正確性或普遍適用性。

比對原文節錄
I had early access, and a longer post is coming, but GPT-6 is stunning & is good enough that it actually does complex me…
X AI 快報#32取得全文

Ethan Mollick 認為,讓組織內多人共同使用 AI 完成目標的「多人 AI」,仍是企業導入時最大的非技術難題之一

Ethan Mollick @emollick

他批評目前做法多半只是把 AI 當成群組聊天室裡的一名成員,這種互動模式限制了跨人員、流程與目標的協作能力。這是他的觀察性判斷,貼文未提供調查資料或實際案例。

一龍馬判讀企業若只增加聊天機器人,未必能處理權限、交接、責任歸屬與共享脈絡等組織問題;產品團隊需要把 AI 設計成協作基礎設施,而不只是另一個對話帳號。

比對原文節錄
Multiplayer AI, where many people in an organization can use AI together to accomplish goals, remains one of the biggest…
X AI 快報#36取得全文

他同時附上可瀏覽的 Netlify 網站,但貼文沒有交代製作時間、人工介入程度、資料來源或史實驗證結果

Ethan Mollick @emollick

Ethan Mollick 分享一個以 Fable 5.1 執行的專案提示,要求建立《伊里亞德》船艦目錄,結合地圖、可探索的精確 3D 船艦、真實影像與考古資料,並由代理測試後反覆修訂。他同時附上可瀏覽的 Netlify 網站,但貼文沒有交代製作時間、人工介入程度、資料來源或史實驗證結果。

一龍馬判讀這類案例把生成式 AI 從文字回答推向互動式教育內容與代理協作製作流程;不過「看起來完整」不等於史實可靠,教師、研究者與使用者仍需核對引用及重建依據。

比對原文節錄
Fable 5.1: "Create the Catalog of Ships from the Iliad with a map, etc.
X AI 快報#56取得全文

Ethan Mollick 認為 Astra 一項不易察覺但實用的進步,是能維持較好的「心智理論」與情境掌握

Ethan Mollick @emollick

依他的使用觀察,最終成品較少莫名提到先前草稿或建構過程,長時間執行時的偏移也較少;他同時強調模型仍不完美。

一龍馬判讀對長流程寫作與代理任務而言,減少脈絡洩漏及目標漂移可能比單次答題分數更直接影響成品品質。不過這是個人觀察,尚缺少系統性測試來界定改善幅度與失敗情境。

比對原文節錄
One of the most subtle valuable things about Astra is that it maintains better theory-of-mind: you don't get nearly as m…
X AI 快報#83取得全文

Ethan Mollick 以擬人化語氣寫道:「別擔心,Codex 沒有掛掉,它只是在等待、做夢

Ethan Mollick @emollick

」文字看似是在幽默描述 Codex 的等待或停滯狀態,但來源未附前文,也沒有服務狀態、錯誤訊息或官方說明可供核對。

一龍馬判讀若使用者正遭遇 Codex 延遲,這則貼文只能視為玩笑或觀察,不能當成停機與否的證據;實際可用性仍須查驗官方狀態與操作紀錄。

比對原文節錄
R to @emollick: Don't worry, Codex isn't down, it just waits, dreaming.
X AI 快報#93取得全文

Ethan Mollick 表示,某項成果先以單一提示生成,之後只要求修正考古圖片的位置,讓讀者不必捲動頁面

Ethan Mollick @emollick

依他的說法,原結果並不差,修改主要出於個人偏好;但貼文未提供成果內容、使用模型或原始提示。

一龍馬判讀這則經驗可作為「一次生成後少量調整」的個案,卻不足以證明特定模型普遍具備相同表現或可靠性。

比對原文節錄
R to @emollick: All one prompt & then I asked it to fix the archaeological images so you didn’t have to scroll.
X AI 快報#95取得全文

Ethan Mollick 表示,他曾追問系統為何對「catalog」採用英式拼法

Ethan Mollick @emollick

貼文未附模型回答、原始輸出或完整對話;此外也未展示實際拼字,因此無法判斷他所指的是「catalogue」或其他形式。

一龍馬判讀拼字在地化會影響文件一致性與讀者體驗,但單憑這句回覆無法評估模型是否誤判語域或地區設定。

比對原文節錄
R to @emollick: I asked why it used the British spelling for catalog.

星期三

X AI 快報#11取得全文

Ethan Mollick 表示,agent 能力與大眾認知之間正在出現新的落差,而且隨能力快速進步而擴大

Ethan Mollick @emollick

他主張,agent 已經能做長時間、自我組織的工作,因此使用 AI 的方式需要改變。這是個人觀察與文章導讀,貼文未提供具體 benchmark、案例或實驗資料。

一龍馬判讀這提醒企業與教育場域不能只用聊天機器人的框架理解 agent,工作設計、監督與授權都要重新調整。限制是目前證據偏評論性,不能直接推論所有 agent 都已可靠適合長流程任務。

比對原文節錄
With agents, we are at another large gap between AI abilities & public perception.