此为历史版本和 IPFS 入口查阅区,回到作品页
深邃月光
IPFS 指纹 这是什么

作品指纹

從AI生成來思考人類的未來

深邃月光
·
·
即使兩人遇到地震的情況是已經寫在劇本中的,但也有許多細節可以講究,以雕琢出自己想要的影片內容。況且,想要什麼影片也只有自己不斷嘗試,要有那種熱情才願意花時間不斷的去試。去看看AI生成的內容之後,再來調整自己的指令。

對於AI生成文字和圖片及影片的速度,是每隔一段時間就加快許多,快到使用者會懷疑是否需要這麼多的算力?就像手機不斷推出新機型,有那麼多功能,還不是用來看影片和聊天居多?但事實證明,需求是被創造出來的。當AI生成的速度加快,使用者的胃口也被養大了,會想要更多的算力來實現自身想要的創作內容。也許是有趣的梗圖,或是更多的帥哥美女影片,又或者是直接製造出一款小遊戲。以前要靠工程師或是有相關技能的專業人士才能達到的,現在靠AI通通都能做到了。

        這大概就是工廠的大量製造概念,例如一下就產生一百張優質的素材,要如何拿來美化報告內容呢?然後發現連簡報都可以一鍵生成了,這樣經過AI快速生成的簡報,是不是更能夠快速消化大量資料,然後使用者就有更多的時間用來娛樂了?而在探索AI生成的指令或關鍵字要如何下的過程,需要耗上一段時間與AI做好溝通,才能生成出使用者想要的標的。如果關鍵字的描述不足以讓AI做出使用者想要的,那就要給出一段想要達到的參考文字或是類似的圖片或影片,以達到想要的效果。

        以小說為例,主角使出某一種武功,可以有不同的展開方式,AI的優勢在於,每一次的生成都是重新計算過,因此武功招式如何出招,可以有許多不同的描述。就像聖鬥士星矢中,主角星矢的主要絕招是—天馬流星拳。由於他要面對很多不同的敵人,所以這一招要使出很多次,等同是每次發招都要揮出新鮮感,才不會讓讀者感覺像是在複製貼上。又以圖片為例,要描述一位少女在河邊散步,可以輸入指令改為拿起地上的一朵花,也可以改為忽然看到一隻青蛙而嚇得跳起來。那麼要如何表現出拿起一朵花的模樣?是直接彎下腰還是蹲下去拾取?被嚇到跳起來是要跳多高?還是只抬起其中一隻腳?

再以圖生成影片為例,就是能讓圖可以動起來數秒的時間,這原本是在遊戲角色中常看到的效果,例如角色換穿新裝之後,會自己擺動一下身體看一看效果如何。或是新收伏的怪獸同伴,會自己做出一些動作,以突顯其特色。而之後的發展,會是以文字生成影片,那麼AI根據文字的描述而做出不同的對應。因為可以讀懂人類的語言,所以也能做出相對應的調整。例如少女在河邊散步改在傍晚,就會出現夕陽的情景;改為下雨就可能會出現拿雨傘的景象,或者會讓少女淋雨。也因此馬斯克才敢斷言,以後人類只要負責下指令,講出關鍵字,或描述一個場景就行,接下來就交給AI去執行了。

        有趣的地方,會是在與AI的互動上面。即使會耗上許多時間,但也能看到不同的成品。相信這也是使用者願意訂閱付費的主要原因之一。例如要製作男女主角遇到地震的情況,就可能要考慮到以下的細節:

第一,到底是要產生多大的震幅?震動頻率為何?震一次大的,還是不停的震?然後身體被震到上下搖晃?還是左右搖晃?

第二,男女主角的反應如何?有沒有特別要求?表情要害怕還是沈著冷靜?肢體動作要如何?手牽手還是扶著建築物的大柱子?

第三,男女主角身上有沒有什麼地方受傷?或是出現什麼可以利用的工具?幫助他們逃離危險的地方?

        即使兩人遇到地震的情況是已經寫在劇本中的,但也有許多細節可以講究,以雕琢出自己想要的影片內容。況且,想要什麼影片也只有自己不斷嘗試,要有那種熱情才願意花時間不斷的去試。去看看AI生成的內容之後,再來調整自己的指令。以前面的地震場景為例,發生地震時兩人要如何表現出那種失去平衡的模樣?是有點站不穩還是直接跌倒在地上?這與地震的強度有直接的相關聯。不能說發生強震,然後兩人只是輕輕感到有點搖晃而已,這樣的影片內容就是不合理的。能夠透過各種生成方式,將心中所想表現出來,也就能讓自身的創作方式更加多元。縱然不是親手從無到有去製作出來,但也利用了AI這樣的工具一點一點的編造出來,並且趨近符合自己的想法。

再者,無論什麼生成方式,目的都在於講述一段故事,內容可長可短,但可以按照自己的需求來重複打磨細節。以月光使用AI生成的經驗來看,有時會發現:

原來還能這樣設計啊!

被AI多變的設計功力所驚訝到,只要稍微做一點更動,就是不同的呈現方式。

        而隨著GOOGLE的生成式AI,在2025年11月21日左右推出的新版本,夾帶著巨大的優勢超前了競爭對手。對於一般的消費者而言,能夠準確的生成圖片中繁體中文的顯示,就是一大躍進了,至少其他對手都還辦不到。經過社群平台幾天不停的洗版,讓月光見識到,所謂的免費試用就是最強大的宣傳,根本就不用另外廣告,就可以讓人躍躍欲試,想要趕快來試用看看,以下是月光看到試用生成圖片的方向歸類:

第一,使用港漫的方式,像是黃玉郎或是馬榮成大師的風格,來生成各式各樣的連環圖畫。也就是一張圖裡面可以有8格左右的分鏡內容,以完成一個連續的對話。

這樣說來,只要把一段對話丟給AI,就可以以一頁港漫的方式,把對方內容生成出來。

第二,使用其他漫畫家的風格來執行港漫,例如以七龍珠的畫風來製成港漫格式,也會變成彩色且多格。這是原作者不太可能會去做的內容,因此很有視覺衝擊感,也只有AI才能達成這種夢幻合作。

第三,可以生成精準的街道圖,再加上想要生成的角色,就能構成自己想要的圖片。例如世界各國總統齊聚台灣夜市,一起享用小吃的合照圖;或是好幾個韓國女團一起集合,逛台灣的名勝古蹟並合照。

        因為身為背景的圖片能夠精準的顯示繁體中文,加上生成的人物也十分逼真,所以看起來就跟真的沒有兩樣。這固然代表AI生成的功力大躍進了,但也代表以假亂真的難度也跟著降低不少。所以眼見不能為憑,所有的圖片和影音,都不能輕信。因為生成的有心人都是先通過自身眼睛的檢視之後,才會傳播出去,以試圖影響社會大眾,甚至製造不必要的恐慌。以全人類的角度來看,不管是什麼樣的著作,除非之後還有在持續運作更新,是十分著名的IP,不然大多會融入到所謂的人類資料庫之中。換言之,超過法律著作權的保護期限之後,都會進入公共領域之中,因此超過兩百年以上的作品,就可以任意的改寫或改作,只要注意不要侵害到著作人格權就好。像是改寫李白的詩,也就是要註明原作者是李白,不能說是自己所創的。

        至於以李白為主角寫的故事,也就是身在唐代的他有可能做出哪些事,或是像三國時代的孔明穿越到現代變成派對咖孔明。大抵上的意思是,只有人名是相同的,但後續發展的故事都是虛構的。就像網路上曾流行的圖文創作,說孔子其實武力值奇高,渾身是肌肉讓人不敢招惹他,所以才能遊歷各國而通行無阻,這樣的故事發展看起來也挺合理的。 AI的衝擊會陸續而來,文字作者在寫文章的時候,嘗試把自己想寫的內容交給AI製作,發現AI寫的跟自己差不了多少,可以說是一樣好。月光是看到老黒寫遊記時,在社群平台上的有感而發。他認為,即使AI寫的比他還要好,但去旅遊而寫成的遊記是他親身所經歷的,因此他還是要繼續寫下去以記下那些美好的時光。

所以說,即使知道在百年後自己的著作可以由他人任意利用,到時自己也已經不在世間了,又何必那麼在意呢?現在只是由AI這個龐大的資料庫來更加有效率的運用這些資料罷了。當然,這並不表示,任意取用當代著名創作者的作品就是不用受到任何限制的。 AI只是把這樣利用的可能性呈現在消費者眼前,也可以說是讓這些資源能夠更有效率的為人類所利用。當然,AI在使用這些資料時,也會朝著有名氣或熱門的方向去取材,而不是以哪種資料份量多,就佔比較重的比例。換言之,該領域大師的作品會優先被採用,而不是被那些相對冷門的作品所稀釋了。因此,即使想要用海量冷門作品來改變AI取材的內容,還是有難度的。

        其實AI往無限算力的方向去發展,就很像在:我來自金星這系列書中所提到的,人的靈魂來到星光層時,就可以取得無限創造出任何物質的能力,甚至操控天氣或地形都可以做到。而唯一的限制就是,不能將這些製造出來的物質任意的銷毀掉,只能再度改造為其他的模樣,這應該可解讀為一種愛惜資源的概念。那麼,有了AI的無限的創作力要如何運用?月光認為,還是要保持一顆正面積極的心。因為無限,就可能會不珍惜,或者無感,就像每天三餐都吃吃到飽餐廳那樣,這可好比人人都變成古代的皇帝那樣,餐餐都吃上滿漢全席,而且也是集全體顧客之力造就的。縱然菜色經常更換,也還是會感到不滿足,而可能會往更珍奇食材去發展。

        那麼,能說吃到飽餐廳的設計機制不好嗎?讓每一位來到這家餐廳的客人,只要付一份錢就可以無限取用餐廳裡的食物,每個人的食量有大有小,就可以互補並共同撐起餐廳的營運。而每個人的飲食習慣,也能影響到整個用餐的氛圍,如果有人喜歡一次拿一整盤,那麼可能就會更改規定,改為由餐廳人員來分配夾取數量。月光覺得,AI生成的速度越快,人的心就要越慢。因為一次所能吸收的訊息量終究有限。而AI整合人類資料庫的能力,可以讓使用者思考自己要的是怎樣的資料?例如也有人請AI生成顯化過程的簡報,讓大腦更了解法則的運作方式,讓人類變得越來越好。這也是其中一種不錯的使用方式,而不會僅侷限在生成更加刺激視覺或聽覺感官的內容。


CC BY-NC-ND 4.0 授权