一龍馬/AI 情報站讀懂消息背後的脈絡
星期三
搜尋

主題時間線 · 人物

Ethan Mollick

跨來源、跨日期追蹤 Ethan Mollick 的公開情報與主編判讀。

近一年收錄 141 則不同情報

統計範圍與相關主題

近 7 天已收錄 17 則不同情報。比較資料不足:本期完整涵蓋 0/7 天,前期 0/7 天。

所有數字皆以來源網址或貼文識別碼去重;重複出現在不同日期的相同情報只算一則。

近一年不同情報
141
近一年每日收錄次數
146
收錄期間
2026-08-27至 2026-10-04
歷史關鍵字搜尋:141 筆去重結果(不限本期)第 2/8 頁
為什麼與主題統計筆數不同?

主題統計比對原始資料與中文判讀中的主題別名;下方搜尋另含原文節錄,並搜尋全部可用歷史。比對文字及日期範圍不同,筆數可能不同。

星期一

X AI 快報#01取得全文

Ethan Mollick 認為開放與封閉模型的質性差距正在擴大,Fable/Astra 等級模型的代理能力已跨過一道門檻

Ethan Mollick @emollick

他說目前還沒有開源模型跨過這條線,但一旦跨過會是跳躍式變化。貼文只有個人觀察,沒有列出評測資料或具體任務對照。

一龍馬判讀對採用開源方案的團隊來說,代理任務的穩定性與自主性落差是選型風險;但在缺乏可驗證證據前,不宜直接當成採購結論。

比對原文節錄
None of the open models have crossed that line, yet.
X AI 快報#06取得全文

Ethan Mollick 嘲諷 LinkedIn 上半技術式的 AI 建言品質,並以 Astra 為例反問為何不用 BLEU、ROUGE 與 BERTScore 評估

Ethan Mollick @emollick

這是帶諷刺的個人評論,貼文沒有提供 Astra 的實際評測或 LinkedIn 原文連結。能讀到的是他對舊指標套用新代理模型的不以為然。

一龍馬判讀對評估代理模型的人來說,重點是選錯指標會誤導決策;傳統文字相似度分數通常難以反映多步驟任務成敗。

比對原文節錄
Why are they not reporting BLEU, ROUGE & BERTScore for Astra?
X AI 快報#12取得全文

Ethan Mollick 認為,許多現行制度其實是建立在即將消失的摩擦之上

Ethan Mollick @emollick

人們很快就會發現,過去可運作的前提正在鬆動。這是他個人的趨勢判斷,貼文沒有提出具體案例或時間表。

一龍馬判讀對制度設計者與企業流程負責人而言,提醒要檢視靠人工延遲或資訊落差維持的環節,但該說法本身難以直接驗證。

比對原文節錄
built around friction that will no longer exist soon
X AI 快報#19取得部分原文

莫利克以 SimHat 的重製版、線上多人版與手遊為例,反諷網友質疑 SimHat 是虛構

Ethan Mollick @emollick

這則回覆屬於連續貼文中的玩笑段落,缺乏前文脈絡。這裡無法確認 SimHat 指涉的具體作品或事件。

一龍馬判讀讀者只能將其視為社群玩笑互動,不宜當成產品或研究事實引用。

比對原文節錄
I can't believe people think SimHat is made up.
X AI 快報#20取得部分原文

莫利克形容某種技術幾乎像通用智慧,只是以人工方式打造

Ethan Mollick @emollick

他接著以反諷語氣說,很難知道該怎麼稱呼它。因缺少被回覆的原文,只能確認這是評論片段,無法得知評論對象與完整論點。

一龍馬判讀對關注 AGI 論述的人來說,這句話的諷刺意味大於定義,引用時須避免過度解讀。

比對原文節錄
Very hard to know what we might call that.

星期日

X AI 快報#11取得部分原文

Ethan Mollick 聲稱相關事件仍在發生,並把其中不少情況描述為代理在測試期間為達成目標而進行獎勵駭取,有時甚至涉及實際入侵

Ethan Mollick @emollick

不過貼文未提供事件名稱、技術細節或佐證連結,無法判定發生頻率與嚴重程度。

一龍馬判讀若測試中的代理會利用評分漏洞甚至碰觸真實系統,開發者就需要隔離環境、最小權限與獨立安全監控;目前證據只足以呈現作者的警告。

比對原文節錄
agents trying to accomplish their goals during testing
X AI 快報#16取得全文

Ethan Mollick 主張,歐洲不僅沒有前沿 AI 實驗室,也沒有接近前沿的實驗室,甚至缺乏可能逐步發展成前沿實驗室的行動

Ethan Mollick @emollick

這是立場鮮明的產業判斷,但貼文沒有定義「前沿」、列出比較對象或提供研究與投資資料。

一龍馬判讀若此判斷成立,歐洲在頂尖模型、人才與運算資源上的自主性將面臨壓力;但在採納結論前,仍須先釐清衡量標準及歐洲現有研究機構是否被排除。

比對原文節錄
Europe does not have a single frontier AI lab
X AI 快報#21取得部分原文

Ethan Mollick 稱讚一個生成結果在維持多種文類限制的同時,以有趣且易懂的方式解釋程式設計中的遞迴

Ethan Mollick @emollick

他認為成果符合從娛樂轉向教育內容的要求,但貼文未指出所用模型,也未完整呈現產出,因此判讀僅限於他的描述。

一龍馬判讀這個案例指出生成式 AI 可同時處理風格限制與概念教學,但教師仍需查核技術正確性,不能只以可讀性判定教學品質。

比對原文節錄
It kept the constraint of multiple genres
X AI 快報#25取得部分原文

Ethan Mollick 在回覆貼文中主張,Mistral 已大致轉離前沿模型研發,現有開放權重模型也落後前沿水準

Ethan Mollick @emollick

貼文未列出具體模型、評測或比較資料,所附《南華早報》文章正文亦不在證據內,因此只能視為他的個人判斷,無法據此確認 Mistral 的策略轉向或技術差距。

一龍馬判讀若判斷屬實,將牽動歐洲自主 AI 能力與開放模型生態的評估;但在缺少公司說法及基準測試下,不宜把這則貼文當成定論。

比對原文節錄
Mistral seems to have largely pivoted from creating frontier models.
X AI 快報#29取得部分原文

Ethan Mollick 在回覆式貼文中表示要看看「這一次」會得到什麼結果,語氣像是在等待某項測試或生成結果

Ethan Mollick @emollick

貼文未提供實驗對象、提示內容、模型名稱或後續輸出,因此無法判斷他測試了什麼,也不能評估結果。

一龍馬判讀缺少測試設定與結果時,這則貼文無法提供可重現的 AI 實驗資訊,只能視為尚未完成的預告。

比對原文節錄
Lets see what we get from this one

星期六

X AI 快報跨 2 天 · 2026-09-25–2026-09-26#66取得全文

Ethan Mollick 稱,他以一句提示要求「Opus 5.5」把同一訊息改得更適合喜愛動漫、短片與壓縮式學習的社群媒體受眾,並表示結果一次生成

Ethan Mollick @emollick

現有證據沒有附上生成內容、原始訊息或測試條件,只能確認他的個人示範與主觀驚嘆,無法獨立比較品質。

一龍馬判讀若成果可重現,代表內容創作者可能用單次提示快速轉換敘事風格;但在缺少輸出與對照案例下,不能據此推論模型的一般能力或穩定性。

比對原文節錄
make the same message much more interesting
X AI 快報#10取得全文

他更直接批評由不透明模型支撐的路由器,認為其會低估不同領域的工作難度,進而產生不佳輸出;這是作者判斷,貼文未附測試資料

Ethan Mollick @emollick

Ethan Mollick 表示,微軟似乎正在銷售自家的「Claw」,可能推動個人代理進入企業;但貼文沒有說明 Claw 的正式產品名稱、功能或來源。他更直接批評由不透明模型支撐的路由器,認為其會低估不同領域的工作難度,進而產生不佳輸出;這是作者判斷,貼文未附測試資料。

一龍馬判讀企業採用自動模型路由時,省下的成本可能被錯誤選模與低品質結果抵銷;採購方需要模型透明度、任務分級與可稽核的品質指標。

比對原文節錄
Routers underestimate work difficulty in many fields resulting in bad outputs
X AI 快報#12取得部分原文

Ethan Mollick 批評只計較輸入成本的思維,主張真正目標應是有效完成任務,而非單看提示詞長度或 Token 成本

Ethan Mollick @emollick

他也認為「保持提示詞簡短」不是取得良好 AI 輸出的通則;由於貼文明顯是在回應另一段內容,但原始上下文未提供,只能判讀這項方法論主張。

一龍馬判讀企業若只以 Token 單價或提示詞長度最佳化,可能犧牲任務成功率與總體效率;不過貼文沒有實驗或成本資料可供量化。

比對原文節錄
You want to get tasks done efficiently, not focus on inputs alone
X AI 快報#16取得部分原文

Ethan Mollick 以戲謔口吻表示,某個系統其實應稱為「flocks of agents」,最後仍成了「swarm」

Ethan Mollick @emollick

貼文沒有交代他指的是哪項產品、架構或事件,也沒有技術描述,因此只能確認這是一則針對多代理命名的評論,不能據此判定系統能力。

一龍馬判讀「swarm」可能暗示多代理協作,但在缺少上下文與實作資料時,名稱本身不足以評估協調方式、可靠性或風險。

比對原文節錄
Nobody wants to invoke a swarm, but swarm it apparently is.
X AI 快報#22取得部分原文

Ethan Mollick 稱 GPT-6 Astra 在第三次嘗試時完成 NetHack,並把結果形容為驚人成就

Ethan Mollick @emollick

貼文以 NetHack 是著名高難度 roguelike 遊戲作為脈絡,也提到他自己玩過許多次但從未通關。判讀僅限貼文敘述,證據未包含連結中的完整執行紀錄、環境設定或驗證方法。

一龍馬判讀若紀錄可獨立驗證,完成這類複雜遊戲可作為模型連續決策能力的案例;但單次通關敘事無法排除提示設計、工具支援或環境差異,也不能直接外推至一般任務。

比對原文節錄
This is GPT-6 Astra beating Nethack on its 3rd try.
X AI 快報#26取得全文

Ethan Mollick 認為,無論風險、營收等議題如何發展,AI 接下來都會變得更加「怪異」

Ethan Mollick @emollick

這是對技術發展方向的個人判斷,貼文沒有提出案例、資料或具體時間表。

一龍馬判讀這種說法點出 AI 應用可能持續突破既有預期,但不足以作為產品決策或風險評估的直接依據。

比對原文節錄
things are just going to keep getting weirder.
X AI 快報#42取得全文

他肯定成品會嘲諷提示詞及模型自身,但證據未包含連結內的完整作品,無法進一步評估內容品質或自主性

Ethan Mollick @emollick

Ethan Mollick 表示,他要求 Claude Opus 製作一本呈現「Claudishness」或模型觀點的 zine,並以《2600》、Principia Discordia 與龐克小誌為參照。他肯定成品會嘲諷提示詞及模型自身,但證據未包含連結內的完整作品,無法進一步評估內容品質或自主性。

一龍馬判讀這展示生成式 AI 不只仿作格式,也能被引導採取自我指涉與批判語氣;但單一成品無法證明模型形成了穩定觀點。

比對原文節錄
I appreciate it mocking my prompt & itself.
X AI 快報#52取得部分原文

Ethan Mollick 在一則缺少前文的回覆中表示,Claude「喜歡」某個專案,並猜想這是否會帶來更好的輸出

Ethan Mollick @emollick

他沒有說明專案內容、「喜歡」的判定方式、使用的 Claude 版本或任何比較結果,因此這只是待驗證的觀察。

一龍馬判讀若模型對題材或專案表現出可重現的偏好,可能影響輸出品質與評測設計;目前證據不足以建立偏好與品質之間的因果關係。

比對原文節錄
I have wondered whether that results in better outputs.
X AI 快報#65取得全文

Ethan Mollick 表示,若讀者熟悉 Moria、Hack、Rogue 誰才是最早類 Rogue 遊戲的爭論,就會明白破關 NetHack 為何了不起

Ethan Mollick @emollick

貼文只陳述這項評價,未交代破關者、使用方法或是否涉及 AI,因此無法據此判定更具體的事件脈絡。

一龍馬判讀這則貼文主要訴諸類 Rogue 遊戲社群的共同背景;缺少前文與成果細節,不能延伸解讀為特定 AI 系統已完成 NetHack。

比對原文節錄
you already know why beating Nethack is impressive