104學習

Adobe Animate

這項技能主要用於製作互動式動畫和多媒體內容,適合網頁設計、遊戲開發及數位行銷領域。具備這項能力的人才能創造生動活潑的視覺效果,提升使用者體驗及吸引力,進而加強品牌形象與產品競爭力。在數位時代,掌握這項工具有助於快速產出高品質動畫,提升職場競爭力與工作效率。

15,438 個相關職缺

提升你的實力,朝專業更進一步

精選課程

充實自己,讓能力持續成長

AE.MG動畫創作實務課
AE.MG動畫創作實務課
動畫師私藏系列|從轉場學會拆解 Motion Graphics
動畫師私藏系列|從轉場學會拆解 Motion Graphics
Canva 短影音AI設計
Canva 短影音AI設計
Blender 3D遊戲建模
Blender 3D遊戲建模
Illustrator向量平面設計
Illustrator向量平面設計
AI 短影音 × 虛擬團隊:企業品牌的影音轉型全攻略
AI 短影音 × 虛擬團隊:企業品牌的影音轉型全攻略
開發者必學:OpenAI API應用與開發
開發者必學:OpenAI API應用與開發
【安卓最新版】Android 9開發首部曲-UI與多頁面設計
【安卓最新版】Android 9開發首部曲-UI與多頁面設計
Substance Painter模型材質貼圖
Substance Painter模型材質貼圖

精選證照

考取專業證照,讓能力被市場看見

ACP Animate 2020 |
Adobe Certified Professional是Adobe官方認可的國際證照,由Adobe與全球最大考證中心Certiport共同合作推出,針對平面影像、網頁設計與影音動畫領域,結合每個軟體所具備的核心應用與知識理論的內容,提供擁有設計軟體使用經驗的人士進行考核認證,考科包含Adobe Photoshop、Adobe Illustrator、Adobe InDesign、Adobe Dreamweaver、Adobe Animate、Adobe Premiere Pro及 Adobe After Effects。 為多媒體設計學習者最該必備的證照,能證實學習者對Adobe核心應用具備相當的熟練度,額外的Adobe設計專家證書,更能展現擁有跨軟體設計專案的能力,藉由認證項目檢視自我是否掌握業界所需,除了了解掌握學習程度,更能為創作作品增加說服力。
Adobe
Adobe Photoshop |
Adobe Photoshop是一個由Adobe Systems出品的專業影像處理軟體。跟公司的其它軟體一樣,Photoshop適用於Mac OS及Microsoft Windows兩個作業系統,同時公司也發布了Unix作業系統上的版本。 Photoshop主要處理以畫素(Pixels)所構成的數位影像。利用其廣泛的編修與繪圖工具,可以有效的進行圖片編輯工作。獨特的歷史紀錄浮動視窗和可編輯的圖層效果功能,能讓使用者可以方便的測試效果。對各種濾鏡的支援更令使用者能夠輕鬆創造出各種奇幻的效果。目前,Photoshop 也正在被廣範地應用在網路影像處理。Photoshop的幾個後續版本中搭配了一個獨立的軟體ImageReady,其加強了Photoshop對網路影像(主要是GIF圖檔)的支援功能。而在CS3中ImageReady被Fireworks所代替。Photoshop CS3以上版本允許使用者更新以容易操作的方式升級到最新的硬體平台。 Photoshop被大部份的人認為是最好的影像處理軟體,但與著名的3D Studio Max一樣,價格昂貴使其難以普及。這也令Jasc Software公司的Paint Shop Pro,GIMP小組的GIMP和友立資訊的Ulead PhotoImpact佔領了不少的市場佔有率。
Adobe
Adobe Illustrator |
Adobe Illustrator是一個由Adobe Systems出品的專業影像處理軟體。跟公司的其它軟體一樣,Illustrator適用於Mac OS及Microsoft Windows兩個作業系統,同時公司也發布了Unix作業系統上的版本。 Illustrator 利用其廣泛的編修與繪圖工具,可以有效的進行圖片編輯工作。獨特的歷史紀錄浮動視窗和可編輯的圖層效果功能,能讓使用者可以方便的測試效果。對各種濾鏡的支援更令使用者能夠輕鬆創造出各種奇幻的效果。目前,Illustrator 也正在被廣範地應用在網路影像處理。 Illustrator 被大部份的人認為是最好的影像處理軟體,但與著名的3D Studio Max一樣,價格昂貴使其難以普及。這也令Jasc Software公司的Paint Shop Pro,GIMP小組的GIMP和友立資訊的Ulead PhotoImpact佔領了不少的市場佔有率。
Adobe
Adobe Certified Associate |
Adobe Certified Associate(簡稱為ACA),它是Adobe第一張國際中文版認證,由全球多媒體大廠-Adobe與國際前三大認證機構Certiport合作推出,主要著重於多媒體網頁設計、數位內容以及媒體傳播的核心應用能力,而考試與課程大綱則包含了多媒體網頁設計、數位內容以及媒體傳播的核心知識與技術。   ACA國際認證將能有效地幫助老師授課及評鑑學生的學習成效,亦可協助企業主確認職員是否能夠有效使用Flash CS3軟體進行創作的能力。
Adobe&Certiport
Adobe Certified Flash Developer |
Adobe Certified Flash Developer認證為Adobe所發之國際認證,針對動畫設計相關之核心應用能力,所規劃的認證項目。其協助網頁與動畫設計工作者,能有效使用 Flash 軟體進行動畫設計創作。
Adobe
Adobe Certified Flash Designer |
Adobe Certified Flash Designer認證為Adobe所發之國際認證,針對多媒體網頁動畫設計設計之核心應用能力,所規劃的認證項目。其協助網頁或動畫設計之工作者,能有效使用Flash軟體進行創作展現。
Adobe

精選貼文,掌握第一手知識

只有我覺得Adobe越來越複雜嗎😢?

Hi大家好,我是阿萍仔,一位平面設計師。 從在學時期就開始接觸繪圖軟體,慢慢從coreIDRAW轉為illustrator的使用者。 20年前的繪圖軟體,還處於發展階段,所以,如踏入設計領域,擁有這項一技之長的技能,是具有一定優勢的能力。而美編設計相關的工作,我們最常使用的作業軟體,多為coreIDRAW、illustrator、Photoshop,當時的Adobe尚未獨佔市場🤨。 認真說起來比較有感的是,設計者所使用的電腦系統偏MAC居多,因設計重視顏色的準確度,如與PC螢幕顯色相比來說,MAC螢幕較無色差,且電腦外型符合美學,還有人性簡化的使用操作,一直以來深受設計師們的喜愛。 15年前,我進了廣告公司,當時是使用QuarkXPress設計軟體來排版,後來,Quark似乎不再提升使用工具的優化,公司同仁開始轉換使用indesign,再搭配illustrator的應用,來提升做稿的效率。也因二者都是Adobe旗下軟體,有了更高的相容性,進而取代Quark格式的不便之處。 就這樣,Adobe積極的開發更多款,設計、多媒體相關的系列軟體,在不是很普及的設計領域中,有了一席之位,逐漸脫穎而出!如今,已成為眾所皆知的繪圖軟體了。 6年前,開始接觸自媒體,踏入YouTube經營,會需要影片剪輯,我直覺聯想到Adobe Premiere。於是,熟悉Adobe介面的我,開始摸索影片串接、上字幕、做特效...功能,基本上,同一間公司所開發的軟體,在工具的使用邏輯不會相差太多,但每次剪完片,總得要花個三天三夜,耗費了我極大的產出心力!我想,應該是我沒有深入了解使用操作的原因吧?!可是,又不知該從何調整,才能加快影片的製作流程。 後來我發現,大家很推薦「剪映」軟體來剪輯影片,於是決定離開舒適圈,來嘗試一下。哇!一用下去不得了,這操作介面也太好入手了,特別是最讓我頭痛的上字幕,竟然可用「識別字幕」的功能,把我影片中的語音,自動識別生成字幕,大大提升了執行的效率,天啊~真心覺得,用過就回不去了啦!😍 別說我沒給Premiere機會,但它近期推出的「AI 語音辨識」讓我非常的失望!是的,有比較就會有傷害,此時我明白了,「選擇」適合的工具,比「努力」深入了解更重要🤣。 這幾年,踏入設計教學中,有越來越多人使用Canva美編排版,因為它有提供多樣的版型,便於使用者可直接套用,輕鬆解決不會美化版面的困擾,深受初學者的喜愛。 那...你想喔!Canva已可以解決基礎的圖文美編了,除非需要再執行更專業客製的設計,illustrator才會派上用場,否則對新手來說,一開始接觸非親民的Adobe軟體時,肯定會滿頭問號到懷疑人生🥲。 好吧!其實這篇文,是要抱怨Adobe的。 我可以理解,購買方案改成「訂閱制」,是商業模式的策略之一,想要抓住使用者的心,也得不斷投入在版本升級的優化更新。只是我發現,Adobe增加越多的新功能,我感受到的是一堆更複雜的介面和工具,讓人不知該從何著手,更無感於提升工作的效率。 沒錯,Adobe加入了一些AI的工具,如:Photoshop「生成式填色」、illustrator「AI向量生成器」、「Retype自動辨識字型」…可是,卻忽略了直覺使用的初衷,唉!原本的簡單變那麼複雜,又沒有執行斷捨離的精神,我很為它擔憂🥲。 最夯的UIUX,意指“使用者介面與使用者體驗”,本為使用者設計為出發點,這才是對症下藥的核心,所以你看!為什麼大家都拋棄Adobe XD,反而是使用Figma。 我們活生生感受到科技帶來的改變,然而不變的是👉符合人性之所需。 對呀!那你覺得呢?
阿萍仔・設計診聊室|甘苦談交流區🥹

Adobe新功能,能夠自動轉動2D圖片轉3D!

Project Turntable 「Project Turntable」,這項工具能讓用戶點擊按鈕並拖動滑桿,將2D向量圖像轉換至不同的視角,並保持原有設計。例如,在Adobe MAX活動中展示的案例中,一條龍的黃色腹部和尾巴,即便在不同角度的旋轉下,也保持了原始設計的完整性。 換言之,這項技術讓設計師無需再從頭繪製圖像,預計未來可顯著減少工作量。
小孤獨・Illustrator

2D 角色一鍵轉 3D!Adobe MAX Sneaks 2024 懶人包:十大更新功能一次看!

在今年的 Adobe MAX 大會上,Adobe 再次展示了令人驚豔的創新技術,特別是每年備受期待的「Adobe Sneaks」,讓設計師與創意專業人士能搶先體驗即將推出的工具。今年 Sneaks 以「重新構想創意流程」為主題,帶來許多突破性的功能,涵蓋 2D 向 3D 轉換、影像合成、動畫生成等,為創作者提供更高效且精準的創作方式。以下是九大亮點功能,幫助你更深入了解這些技術如何解決創作中的常見問題。 ▍Project Turntable:2D 角色一鍵變 3D 「Project Turntable」是這次 Sneaks 的亮點之一,它能將 2D 向量圖像轉換成 3D 視圖,讓設計師像操作 3D 模型一樣旋轉角色,同時保留其 2D 編輯屬性。這對於角色設計師或故事板創作者來說,節省了繪製三視圖的時間,讓角色能更靈活地呈現多個角度,無需反覆手動調整。 ▍Project Scenic:生成並編輯 3D 場景 透過 AI 自動生成 3D 圖像,設計師可以快速微調場景中的物體位置、大小及相機視角,縮短了手動設置的時間。這對於需要快速搭建場景的設計師來說是一大福音,讓創作流程更加順暢。 ▍Project Super Sonic:AI 自動生成音效 「Project Super Sonic」透過 AI 技術,讓創作者可以直接點擊影片中的物體,自動生成符合情境的音效。這對於需要大量音效處理的影片剪輯師來說,大大減少了從素材庫中尋找音效的繁瑣過程,並能細緻調整前後景的音效,實現更完美的音效平衡。 ▍Project Perfect Blend:一鍵融合光影 透過自動調整光線和陰影,讓合成照片中的物體能夠自然融入背景。無論是過曝或曝光不足,這項技術能完美補償光影差異,保證最終影像效果自然、專業,極大地提升影像編輯效率,特別適合需要頻繁處理合成影像的設計師。 ▍Project Clean Machine:消除影片瑕疵與閃光 能自動消除影片中的過曝閃光和不必要的物體遮擋,還原清晰、流暢的畫面。這項技術可輕鬆分析影片前後幀,智能補帧並移除瑕疵,讓影片後製變得更加高效,減少手動調整的工作量。 ▍Project In Motion:用文字生成動畫 這是一項改變動畫製作方式的技術,只需要輸入簡單的描述,像是「開心果冰淇淋」,「Project In Motion」就能自動生成對應動畫。這讓沒有動畫經驗的使用者也能輕鬆創作,並且可以進一步整合到 After Effects 中進行精細調整,無需從頭開始繪製或製作。 ▍Project Know How:數位內容追溯 「Project Know How」讓影像和影片的來源更加透明,透過數位憑證技術,即便素材被編輯過,依然能保持內容的憑證元數據,保證素材的可追溯性。這對於媒體和創作界來說至關重要,讓素材的合法性和可信度有了更高的保障。 ▍Project Remix A Lot:草圖轉精美設計 「Project Remix A Lot」讓設計師可以將手繪草圖快速轉換為數位設計,並自動生成不同尺寸的設計檔案。對於需要多尺寸輸出的廣告設計師來說,這大大提升了效率,省去了重複調整和重新排版的步驟,讓設計變得更加靈活高效。 ▍Project Hi-Fi:高品質圖像生成 「Project Hi-Fi」可快速生成高品質圖像,並無縫匯入 Photoshop 進行後續編輯,這對於需要大量處理高解析度素材的設計師來說,省去了繁瑣的設計步驟,讓每一個創作細節都能保持完美,創作流程更加流暢。 ▍Project Light Scape:動態光影模擬 最後一項展示的「Project Light Scape」是一項針對光線和陰影的動態模擬技術,讓設計師能更精準地控制不同光源下的效果。無論是燈光位置、光線強弱或反射效果,都能即時調整並模擬現實世界中的光影效果,尤其適合處理複雜場景設計或產品展示。 2024 年的 Adobe MAX Sneaks 為創意工作者帶來了突破性的創作工具,這些技術不僅提升了工作效率,還大大減少了手動繁瑣的設置步驟。無論你是從事 2D 動畫、3D 設計、影像編輯或是音效製作,這些功能都將改變你的工作流程,幫助你更快、更精準地實現創意想法。Adobe 正在持續引領創意技術的未來,讓每一位創作者都有更強大的工具來實現他們的願景。 ➤ 影片來源:https://www.youtube.com/watch?v=gfct0aH2COw&t=2s ➤ 歡迎在104學習精靈關注【AI趨勢報-科技愛好者的產地】獲得更多科技新知!
知識貓星球・AI 趨勢報-科技愛好者的產地🤖

Runway Act One :簡單操作、創作真實表情動畫的影片生成 AI 新工具|功能介紹、應用場景

隨著AI技術發展,動畫創作門檻越來越低。Runway 推出的 Act One 讓創作者僅需簡單的攝影設備和演員表演,就能生成栩栩如生的動畫角色,解決了傳統動畫製作繁複的問題。不管是內容創作者、動畫師或是影視愛好者,都能利用這款工具提升作品表現力與創意。 ▍Act One 是什麼?Runway 如何改變動畫生成方式 Runway Act One 是一款創新的影片生成工具,特別為生成具有真實表情的動畫角色而設計。不同於傳統動畫的複雜流程,Act One 不需要高成本的動作捕捉設備、特定的3D建模技術或繁瑣的手動面部綁定。只需一台消費級的攝影機和一位演員,Act One 就能通過演員的真實表演自動生成符合動畫角色的表情和動作。這項技術解決了創作者長期以來遇到的問題:如何在有限的資源下生成帶有豐富表情和真實動作的動畫角色。 對內容創作者和動畫設計師來說,這是動畫生成的一大突破,不僅簡化了製作流程,還縮短了製作時間。無論是廣告、短片還是社群媒體內容,Act One 都能夠讓創作者輕鬆產出具有電影感的高品質影片。 ▍Act One 的核心功能與優勢 ● 簡單易用的操作方式 Act One 的使用流程十分簡單,只需要一台普通攝影機錄製演員表演的影片作為輸入,不需要任何額外的設備或專業的動作捕捉技術。演員的細微表情、視線移動、動作節奏都會被精確捕捉並反映到動畫角色中,創作者可以省去複雜的操作流程,專注於影片創作本身。 ● 真實情感表達 Act One 能忠實地將演員的表情、情感及微表情細節表現在動畫角色上,特別適合需要展現真實情感的角色影片。這讓動畫角色不再只是冷冰冰的數位形象,而是能夠真正與觀眾產生情感連結,提升作品的深度和感染力。 ● 語音與表情變化同步 除了表情動作,Act One 也支持語音同步,讓動畫角色的嘴型、表情和語氣更加自然生動。這對於多角色對話或長篇敘事的影片來說尤其重要,能夠加強角色之間的互動和交流感。 ● 穩定多角度生成 Act One 對不同攝影機角度的影片表現出很高的穩定性。無論是在近距離特寫還是遠景拍攝下,它都能保持面部表情和動作的連貫性,這讓使用者可以更自由地設計畫面,創作出多元視角的高質量動畫影片。 ● 突破傳統動畫製作的局限 在 Act One 之前,動畫製作通常需要多步驟的技術支持,包括動作捕捉和3D建模等。但 Act One 的創新技術只需要使用簡單的影片作為輸入,即可將演員的表情和動作無縫轉換成動畫角色表演,節省了大量的人力和時間,讓更多人能夠輕鬆進行動畫創作。 ▍Act One 的應用場景:多角色對話與創意敘事 Act One 的一大亮點在於它能支持多角色對話場景,適合創作者在單一場景中製作多個角色互動的影片內容。藉由 Act One 的技術,創作者可以利用一位演員的表演,驅動多個角色的表情變化,實現複雜的對話場景。這對於敘事影片、動畫劇集甚至電影來說,都是一項非常實用的功能。 以往這樣的多角色互動場景需要大量的手工動畫製作,但現在只需單一攝影機拍攝,Act One 就能幫助創作者輕鬆實現多角色之間的真實互動。這不僅讓創作者的構思能夠以更低的成本、更高的效率實現,也讓動畫製作的可行性更大。 ▍安全性:Runway 的負責任創作策略 Runway 對於 Act One 的開發和應用設有嚴格的安全保障措施,確保創作不被不當濫用。Act One 內建的內容審查系統會監控生成影片的安全性,並阻止使用者試圖生成公眾人物的內容。此外,Act One 還透過技術手段確保用戶在使用自定義語音時擁有合法的使用權,以保障創作者的權益。 這些安全措施讓 Act One 能夠在為創作者提供便利的同時,也避免了生成影片被濫用的風險,推動了負責任的生成式AI技術應用。 ▍Act One 將動畫創作帶向新高度 總的來說,Runway Act One 是一款極具創新性的影片生成AI工具,將以往需要高技術門檻的動畫製作簡化為人人皆可操作的流程。透過 Act One,創作者能夠輕鬆生成帶有豐富表情和真實感的動畫角色,無需繁瑣的技術支持,開啟了動畫創作的新途徑。 ➤ 了解更多:https://www.youtube.com/watch?v=z3F0ei62Kmk&t=3s ➤ 歡迎在104學習精靈關注【AI趨勢報-科技愛好者的產地】獲得更多科技新知!
知識貓星球・AI 趨勢報-科技愛好者的產地🤖

不用錢!4個免費AI影片生成工具,效果媲美OpenAI Sora、Gemini Veo

OpenAI 新影片生成模型 Sora2 不論質感多真實,我這種免費仔就是不想花錢買😝,但要 AI 做影片的話,在 Google 找到的免費生成影片工具,實際使用之後就發現只能免費體驗一次😑,不然就是點數不夠用!還是要付費買會員,這篇要分享我自己私藏的 4 個免費 AI 影片生成器🎦,文字/圖片轉影片 AI 一鍵生成~真的不用錢! 4 個免費 AI 影片生成工具:(點擊快速抵達) ✨免費生成影片AI:Dreamina 🫘免費生成影片AI:豆包AI 💬免費生成影片AI:Qwen 🚀免費生成影片AI:Grok 🔥表格比較 4 個免費 AI 影片生成工具 1. ✨免費生成影片AI:Dreamina 跟剪輯軟體 CapCut(剪映)是同家公司,所以可以把 Dreamina 生成的 AI 影片,直接整合到 Capcut 後置編輯。Dreamina 有 2 種生成影片的方式:1️⃣輸入提示詞生成、2️⃣上傳圖片轉成影片,影片生成後,如果需要更高畫質,還可以升級成 HD 。 我覺得 Dreamina 製作卡通動畫的效果比寫實影片還優秀,有時候擬真會在小細節出現破綻,比如手指不見之類的(怕.gif),但整體來說影像細緻是很高的👍,我自己很常用它來生成圖片! 點擊快速回目錄⤴ 2. 🫘免費生成影片AI:豆包 AI 豆包的本體是聊天機器人,就像 ChatGPT、Gemini 那樣,可以問答、研究、做簡報、 AI 繪圖以及製作影片,超級萬能!而且影片還是免費的🤩 我很常用豆包生成真人的影片素材,擬真度高!可以補足前面提到 Dreamnina 常出現破綻的缺點~ 可是豆包在台灣沒有開放 APP ,所以只有網頁版可以用💻。另外,生成影片的方式目前只提供輸入提示詞,想要得到理想的畫面就要魔術的詳細一點喔! 點擊快速回目錄⤴ 3. 💬免費生成影片AI:Qwen 滿少人知道 Qwen 這個 AI 助手,我超愛用!因為他沒有使用上限!不只能理解文字,還具備處理多模態的能力,圖像、音訊、影片它都讀得懂。Qwen 生成出來的影片可以明顯感受到光影的氛圍感,很適合拿來做 MV 或是微電影 但......美好的事物都需要等待的......⏳ Qwen 製作 AI 影片的速度超——慢——通常需要大概 3 分鐘或更長的時間 點擊快速回目錄⤴ 4. 🚀免費生成影片AI:Grok Grok 是我在手機上最常用的影片生成工具,速度快🚀!他與其他 AI 影片工具不同的地方是,輸入提示詞後,會先給我多張靜態影像,當我選擇一張後,在把這張當作第一幀延伸成影片。基於這樣的生成模式,所以可以加速製作的效率,不用等影片做完才發現不喜歡,又要重新再做一次! 唯一的小缺點就是,場景跟氛圍都有一種圖庫感😂 雖然是寫實風格,但看起來很像是在專業棚拍的攝影照片~ 點擊快速回目錄⤴ 5. 🔥表格比較 4 個免費 AI 影片生成工具 優點 ✅缺點 ❌Dreamina可生成高品質 HD 寫實風格容易有破綻豆包擬真度高,很真實沒有 APPQwen光影效果強速度慢,需 3 分鐘或更久Grok速度快,可手機操作品質像圖庫攝影照 老實說,我選不出最好的影片生成 AI 工具>< 因為這 4 個都是我現在會交替使用的,如果要做動畫我就用 Dreamina ,如果需要真實人物的素材我就用豆包,如果要做像電影的夢幻質感我就用 Qwen ,如果沒電腦又要快速生出影片我就用 Grok,反正,這 4 個 AI 影片工具都很值得收藏起來啦💗 如果喜歡我的分享,來追我 IG 唷!我都在上面分享 30 秒就能躺著學會💤的 AI 工具+職涯成長內容~ 點擊快速回目錄⤴ 我以前常困擾,怎麼在社群讓別人看到我厲害的地方我想要其他人來找我合作,多賺一點錢💰但我把專業寫在 IG 或 Threads 的介紹都沒用==認真想想,可能這兩個平台都是玩樂性質的關係吧後來,我看到同事在用台版 LinkedIn,超酷!每個人名字旁邊都會顯示職業,不怕別人不知道我是做什麼的我馬上創了一個帳號!現在有閒就發炫耀文📱就是可以展現自己專業知識的貼文,比如:我怎麼用 AI 做超屌的動畫之類的我還在上面建一個可公開又比較輕鬆版的履歷沒想到發文刷存不到一個月,就收到合!作!邀!約!現在變得好忙哈😆 除了正職還多了 2 個副業💰💰💰真的很推薦想增加收入的來一起玩人才社群~~~ 作者:職迷不霧點我追蹤職迷不霧 IG ❤️❤️❤️ 延伸閱讀:【AI聊天機器人】推薦選哪個?4大AI比較!馬上找到適合的AI助手:ChatGPT、Grok、Gemini、Deepseek【AI做報告】4個超推薦AI報告工具!幫你生成報告、找文獻、做簡報PPT、套設計模板必備【AI翻譯工具】最推薦5個AI即時翻譯,幫你自動翻譯任何語言,免費vs訂閱、優缺點評比一次看!【AI語音筆記】超推薦5個AI轉文字工具!幫你生成逐字稿與會議記錄重點,免費vs訂閱、優缺點評比【AI懶人包】看這篇就夠!2026推薦AI免費vs訂閱工具大全,提高工作生產力&amp;職場競爭力!(持續更新)
【104職場力】・AI

OpenAI推出ChatGPT Images 2.0支援多語言、思考精準度再升級!

OpenAI近日正式推出「ChatGPT Images 2.0」,與過往模型相比,Images 2.0不僅能理解更複雜的視覺指令,還能局部編輯、調整長寬比,更首度將思考能力與影像創作結合,讓AI影像從單純的生成圖片,進化成具戰略設計能力的視覺工具,來看看有哪些特點吧! 文/《104職場力》 本文導覽 1.結合思考能力,支援網頁搜尋與多圖生成2.精準度大幅提升,複雜構圖也沒問題3.支援多語系,繁體中文顯示更流暢4.可局部編輯、調整圖片比例,創作更彈性5.整合Codex與API開發應用訂閱方案與供應狀況 1.結合思考能力,支援網頁搜尋與多圖生成 ChatGPT Images 2.0的最大亮點在於其「推理」特質,當使用者在ChatGPT中選擇「推理(Thinking)」或「Pro」模型時,影像生成過程會有以下進階功能: 即時資訊查詢:模型可透過網頁搜尋獲取最新資訊,確保影像內容(如教學圖表、新聞摘要)符合時事。 多圖同步生成:支援單次指令生成最多8張具備連貫性的影像,適用於漫畫分鏡、室內設計多方案對比或系列海報設計。 自我修正機制:在生成過程中,模型會先行構思影像結構並反覆核對輸出,大幅降低指令理解偏差。 2.精準度大幅提升,複雜構圖也沒問題 Images 2.0解決了過往AI生成圖最常見的痛點,能夠產出真正可直接投入使用的成品,包含以下特點: 能處理更精細的元素:包含更小字體的文字、圖示、UI使用者介面元件,以及密集的構圖排列。 擬真的視覺風格:顯著提升了照片的真實感(包含細微的自然瑕疵),並能精準捕捉電影劇照、像素藝術(Pixel Art)及漫畫(Manga)等特定風格。 高解析度:透過API串接,最高可支援2K解析度的影像輸出。 ▲104職場力小編實測,用ChatGPT Images 2.0生成宣傳圖,排版和小字、細節都處理得很好。 3.支援多語系,繁體中文顯示更流暢 過往圖片模型在非拉丁語系(如中、日、韓文)的文字呈現常出現亂碼或筆劃錯誤,Images 2.0強化了多國語言理解力,特別是繁體中文、日文、韓文、印地文及孟加拉文的表現更優異,這讓語文不再只是標籤,而是能完美融入海報、說明圖或圖表中,成為設計的一部分。 4.可局部編輯、調整圖片比例,創作更彈性 「局部編輯」和「彈性調整圖片比例」也是這次ChatGPT Images 2.0的重要亮點之一,為了滿足不同數位媒介的需求,Images 2.0提供了極高的靈活性,支援從極寬的3:1到極窄的1:3比例,無論是簡報投影片、社群媒體圖貼還是電子書籤都適配;另外,模型的知識庫截止日期更新至2025年12月,使用者在製作教學素材或資訊圖表時,能提供更精確且具時代感的內容。 ▲ChatGPT Images 2.0生成圖片後,可進行局部編輯。 ▲編輯時點選右上角「長寬比」即可調整比例大小,也可以直接在對話框中下達Resize的指令。 5.整合Codex與API開發應用 除了ChatGPT介面,新模型也深度整合至各項開發工具: Codex工作區:設計師與行銷人員可在Codex內直接生成UI原型或廣告草案,並快速迭代至產品端,無需切換工具。 API正式上線:開發者可透過gpt-image-2串接API,將高品質的自動化圖像生成功能導入第三方應用程式,如在地化廣告生成或創意自動化系統。 OpenAI坦言Images 2.0仍非完美,因目前模型在處理「物理空間邏輯」方面仍具挑戰,例如摺紙步驟圖、魔術方塊邏輯,或是極度密集的細節(如沙灘上的沙礫),因此仍建議使用者在圖片生成後還是要進行人工審核。 訂閱方案與供應狀況 ChatGPT Images 2.0目前已全面開放給所有ChatGPT與Codex使用者,但Thinking這項進階功能則優先提供給ChatGPT Plus、Pro及企業版(Business)用戶,API則依據影像品質與解析度設定採差別計費。 https://www.youtube.com/watch?v=-7JSa_luc6k (資料來源:ChatGPT官網) 延伸閱讀: 「Claude Design」新登場!生成原型、簡報怎麼做和修改?Anthropic設計師建議使用技巧 ChatGPT Images 2.0生成海報文宣怎麼做?文字告別亂碼、排版調整實測
【104職場力】・AI

Meta 首款模型 Muse Spark Meta AI App 及 Meta.AI 網頁全面升級

2026-04-09 經濟日報記者彭慧明 由聯合新聞網授權轉載 Meta宣布,正式推出全新語言模型Muse Spark,是Meta Superintelligence Labs打造全新系列的大型語言模型中的第一個模型。 Muse Spark是Meta專為旗下產品量身打造的全新模型,也是迄今最強大的模型,有效提升Meta AI的效能及反應速度。目前已導入Meta AI App及Meta.AI網頁,支援進階邏輯推理與多模態任務處理。並預計於未來幾週內,陸續推展至Facebook、Instagram、Messenger、WhatsApp與AI眼鏡中。Meta也將透過API限定開放模式,提供給特定合作夥伴搶先體驗。 Meta在Muse Spark中導入強大的多模態感知能力,與其他AI需仰賴用戶逐一輸入描述不同,Meta AI不只能讀懂使用者輸入的文字,更能直接看見並理解大眾提供的視覺資訊。 例如,只要拍下機場零食架的照片,Meta AI就能辨識並排序出蛋白質含量最高的零食,無須費力查看營養標示,只要直接掃描商品,即可快速了解不同零食的成分差異。Meta AI應用於AI眼鏡時,AI助理將更清楚掌握並理解周遭環境。 健康資訊是大眾使用 AI 的主要需求之一,Meta AI透過Muse Spark的多模態感知能力,將可評估不同情境的影像與圖表,提供更細緻的回覆。Meta AI攜手臨床醫師專團隊,提升模型在常見的健康相關問題上,提供健康與醫療領域相關資訊,回應協助大家理解與健康有關的疑慮。 Muse Spark也擅長視覺化程式開發(visual coding),只需要輸入提示詞,就能建立客製化網站與小遊戲。未來可以請Meta AI製作一個用來規劃驚喜派對的儀表板、快速生成一款復古街機遊戲邀請朋友一起挑戰,或推出一個充滿想像的飛行模擬器,並將這些遊戲內容分享給朋友。
【104職場力】・AI

從畫筆到數位創作──內思高工多媒體設計科的專業養成與創意實踐

在數位內容快速發展的時代,多媒體設計已成為結合創意與技術的重要領域。位於新竹的內思高工多媒體設計科,透過「手繪為本、數位為用」的課程架構,帶領學生從基礎美感培養出發,逐步延伸至動畫、影像與互動設計,建立跨媒介的整合能力。多媒體設計科庭裕主任指出,設計教育的核心不只是讓學生學會工具操作,而是培養「能夠思考與表達的能力」。「AI可以生成圖像,但它不是創意的源頭,真正的設計還是來自人的想法與判斷。」主任強調,學生必須先具備基本的觀察與創作能力,再透過數位工具與AI輔助延伸,而非完全依賴技術取代思考。 從手繪出發:「每日一畫」建立設計的基礎能力 內思高工多媒體設計科的課程設計,以明確的分年學習架構展開。高一階段以手繪與設計基礎為主,透過繪畫、圖學與基礎設計課程,建立學生的美感與表現能力。其中,「每日一畫」是最具代表性的訓練之一,學生需每天完成繪畫練習,扎實培養將想法轉化為圖像的能力。 圖:學生練習「每日一畫」作品 主任認為,設計的第一步不是直接操作電腦,而是「能不能把腦袋裡的東西畫出來」。「手的感覺是最直接的,想法要先透過手呈現,才有可能進一步轉化成數位作品。」這樣的學習過程,對許多學生而言並不輕鬆。並且,設計並非是單純的藝術表達,而是一種溝通與傳遞的方式。多媒體設計科的彭同學提到,自己原本只是單純喜歡畫畫,但進入科系後才發現,設計並不只是畫自己喜歡的內容,而是需要考慮「他人是否能接受」,甚至必須符合特定需求。「以前是畫自己喜歡的東西,但現在會去想,這個設計是不是別人也會覺得好。」這樣的轉變,也反映出設計工作與他人之間緊密的關聯性。 數位技能導入:從創作到媒介整合 進入高二後,課程逐步導入數位工具與媒體應用,包括電腦繪圖、3D動畫、影像製作與虛擬實境等內容。學生開始學習如何將手繪基礎轉化為數位作品,並使用AI製作及修正產生更廣泛的媒介形式。 其中,「互動動畫設計實作」課程特別具代表性。學生需以自身興趣為出發點,規劃主題、撰寫腳本、進行拍攝與剪輯,完成一支完整的影音作品。這樣的課程不僅訓練技術操作,更整合了企劃、表達與敘事能力。多媒體設計科的潘同學分享,自己原本期待能夠專注於拍攝影片,但實際學習後發現,需要先建立繪畫與設計基礎,才能讓影像創作更完整。「原本以為就是一直拍影片,但後來發現學到更多,包含畫畫、設計和不同媒材的應用。」這樣的學習歷程,讓學生逐漸理解,多媒體並非單一技能,而是一種跨領域整合能力。 此外,課程中也導入攝影與構圖訓練,讓學生理解影像的基本語言。主任指出,無論是動畫、設計或影像創作,視覺構成能力都是核心,「構圖、光影、畫面感,這些都是共通的基礎」。 圖:學生數位作品紀錄 從創意到實踐:設計思考的深化 在能力逐步累積後,課程進一步強調設計思考與創意發想。學生透過參加校內「創意構思競賽」,練習具體設計概念,並接受業界與教師的評估,從參賽經驗中學習如何讓創意回應真實需求。 主任指出,學生常出現的問題,是過度沉浸於個人想像,卻忽略設計的目的。「設計不是只為自己,而是要解決問題。」因此,課程會引導學生進行資料蒐集、使用者分析與實際驗證,讓創意能落地成為可行的設計。這樣的訓練,也培養學生面對修改與挑戰的能力,也建立了面對挫折的心理韌性。彭同學回憶,在進行大型水墨作品時,曾因不確定如何下筆而感到焦慮,但最終透過自我練習與同儕討論,完成作品。「完成的時候會覺得很有成就感。」她說。主任則強調,設計能力的建立需要時間累積,「先模仿,再轉化,最後形成自己的風格」,這是一個必經的歷程。 圖:彭同學水墨畫成果 高三階段,學生需整合三年所學,完成專題製作並對外展出。這不僅是學習成果的呈現,也讓學生有機會接受外界回饋。在專題製作中,學生可依興趣選擇方向,包括動畫、影像、平面設計或產品設計等。潘同學分享,自己在畢業專題中負責微電影製作,從劇本撰寫到拍攝與剪輯皆親自參與,他回憶「影片完成的時候會覺得很滿意。」 從學習到未來:多元發展的可能性 在升學發展方面,多媒體設計科學生多以升學為主,延伸至視覺傳達、商品設計、室內設計、建築與多媒體相關科系。主任指出,設計群本身具有高度延展性,「只要有美感基礎,可以發展的領域很多」。 學生的選擇也呈現多元樣貌。彭同學希望未來朝產品設計發展,而潘同學則考慮以建築作為主要專業,同時持續發展影像創作。這樣的路徑,也反映出多媒體設計科所培養的,不只是單一技能,而是一種可延伸的能力基礎。 在創作與實作之間,培養可持續發展的能力 內思高工多媒體設計科,以手繪為起點,逐步導入數位與AI的媒體應用,建立從創意發想到實作完成的完整學習歷程。在這樣的訓練中,學生不僅學會設計技術,更在反覆修正與實踐中,培養出表達能力、問題解決能力與創意思維。 對國中生與家長而言,多媒體設計科所提供的,不只是進入設計領域的入門訓練,而是一條將「想法」落地為技能的學習路徑。在這樣的過程中,學生能為未來的升學與職涯發展奠定穩固基礎。 開箱多媒體設計科學習日常!更多科系探索,歡迎追蹤104高職生IG 在 Instagram 查看這則貼文 104高職生(@104v.hs)分享的貼文
【104職場力】

用AI快速做商品廣宣圖:Manus AI一鍵生成視覺文案行銷素材,電商小編必學

電商和社群小編每天都和時間賽跑,如何用AI快速產生高品質的商品廣宣文案與視覺圖片?本文以Manus AI示範,只要上傳隨手拍的產品照,輸入簡單的需求,就能自動產生專業的文案與圖片!跟著詳細步驟教學,讓AI工作成為行銷工作的最佳夥伴,本文節錄自《用AI做設計》。 文/施威銘研究室 本文目錄(點擊可快速前往) 電商小編的救星!隨手拍的照片也能變成廣宣圖【Manus AI】用AI自動產生廣宣文案及圖片 電商小編的救星!隨手拍的照片也能變成廣宣圖 在電商快速發展的時代,品牌商與代理商經常需要做各種產品廣宣,並進行多平台的行銷推廣。然而,專業攝影往往得花大量的時間與資源,對於忙碌的電商小編來說,並非每次都能安排專業的攝影。 現在有了AI即使是隨手拍的產品照,都能輕鬆轉成廣宣素材,重點是不用自己去背、想文案,只要上傳照片就能在短時間內完成。 隨手拍的桌上型電扇,背景雜亂、光線不佳。透過AI的處理,馬上變成一張廣宣素材(圖/旗標出版提供) 【Manus AI】用AI自動產生廣宣文案及圖片 【使用AI】Manus 電商小編與社群小編每天都在和時間賽跑,得產出大量高品質的廣宣文案與視覺圖片。面對不斷湧現的行銷需求,該如何在有限的時間內,產出吸睛且符合品牌調性的內容?AI正是你的得力助手,只要上傳隨手拍的產品照,輸入簡單的需求,就能瞬間產生專業的文案與圖片,減輕工作負擔。底下我們以Manus AI做示範。 Manus:https://manus.im/home 【Step 1】 請開啟網頁瀏覽器,輸入「https://manus.im/home」網址,連到manus網站,這是一個通用型的AI網站,可以幫你解決各項工作及生活中的問題,進入網站後點選畫面右上角的開始使用鈕,接著使用Google帳戶註冊即可開始使用各項服務。 按下開始使用(圖/旗標出版提供) 點選Google帳戶或使用Apple ID註冊(圖/旗標出版提供) 【Step 2】 首次註冊會得到1000免費積分以及每日登入的300積分,你可以先用免費積分試用各項功能,再決定是否付費(註:官方贈送的免費積分可能會隨時變動,在此僅供參考)。 首次註冊、登入會得到免費積分,請按下知道了關閉此訊息(圖/旗標出版提供) 【Step 3】 接著,在輸入框中輸入你的需求(提示語),在此我們想將隨手拍的照片製作成促銷廣告。 輸入需求(請製作一張直幅的促銷廣告,文字使用繁體中文)+上傳檔案 輸入需求並上傳檔案(圖/旗標出版提供) 【Step 4】 送出需求後,manus就會開始處理,大約等個20多秒就會生成圖片及廣告文案。 自動生成廣告文案、生成兩張圖供我們參考,點選縮圖可放大瀏覽(圖/旗標出版提供) 自動去除照片中雜亂的背景,並加上文案,可惜文字大多是亂碼(後續可使用影像處理軟體來修改)(圖/旗標出版提供) 廣告文案包含主標題、副標題及產品特點,這些都是AI自動產生的(圖/旗標出版提供) 【Step 5】 由於AI生成的中文字大多為亂碼,在此我們可以將AI生成的圖片及文案下載到電腦裡,後續再用影像處理軟體來修改文字。 (圖/旗標出版提供) 下載檔案(圖/旗標出版提供) 下載後的檔案為壓縮檔,會存放在電腦中的Downloads資料夾,解開壓縮檔就可以進行後續的修改(圖/旗標出版提供) 【Step 6】 你可以使用AdobeExpress或是Photoshop的生成填色功能,將中文亂碼的部份去除並與背景融合,再自行輸入文字。 AdobeExpress:https://www.adobe.com/tw/express/ Photoshop:https://www.adobe.com/tw/products/photoshop.html (圖/旗標出版提供) 【TIP】如果覺得要刪除中文亂碼並與背景融合很麻煩,你也可以直接將manus生成的圖餵給ChatGPT,請它「生成一張去除文字的圖」。這樣後續只要輸入文字就可以了。 節錄自:旗標出版《用 AI 做設計:沒時間?沒素材?沒靈感?就 Call AI 救援》/施威銘研究室 著 推薦閱讀: AI生成圖卡教學!ChatGPT打造專屬社群配圖,告別圖片荒 「模糊照片背景」免費AI工具推薦!輕鬆告別雜亂、重點更聚焦 ChatGPT-4o更新圖片生成模式升級!照片Q版貼圖、漫畫生成怎麼做? ChatGPT生成Excel圖表不卡關!xy軸設定、中文顯示問題輕鬆搞定
【104職場力】・AI

ChatGPT可以轉檔JPG、Word、PDF嗎?讓AI一站式解決20種轉檔任務

想把圖片如PNG、JPG轉成其他格式,或把Word等文字檔案轉檔,或將PDF合併成報告,這些瑣碎的任務能用AI完成嗎?解析如何透過ChatGPT等AI工具,一站式完成Word、JPG、PDF、Excel等多達20種轉檔任務,無需再依賴多款軟體,節省大量時間與精力,讓AI成為你的最佳工作助手!本文節錄自《30個必學的AI行政工作術》。 文/賴彥廷 本文目錄(點擊可快速前往) 讓AI幫你轉檔!ChatGPT一站式處理轉檔工作【STEP 1】快速掌握20種ChatGPT轉檔功能問題:ChatGPT可以轉檔影片嗎?【STEP 2】設計ChatGPT轉檔指令3大重點【STEP 3】出現缺頁或文字亂碼?讓ChatGPT修正錯誤【STEP 4】下載檔案【技巧升級】快速下載多個檔案的訣竅 在工作中,你是否經常需要做各種「轉檔」工作?早已準備好多款不同的應用軟體,還是每次遇到問題才急急忙忙尋找線上工具? 轉檔是職場生活中既不起眼又耗時的繁瑣事務。舉例來說,把多份PDF檔案合併成完整報告,或是將圖片轉換為指定格式。 雖然市面上有不少線上工具可以處理這些任務,但真正的麻煩在於,我們必須適應多種軟體,才能應付五花八門的轉檔任務。 試想一下,PDF合併需要一種工具,照片格式調整用另一種,至於影片處理、錄音格式轉換,甚至將網址製作成QR Code,都需要用不同的軟體來處理。更麻煩的是,找到操作簡單、功能強大的工具往往需要花不少時間試用和篩選。 如果能有一個「一站式」工具解決大多數的轉檔工作,省去來回切換軟體的麻煩,那該有多好! 讓AI幫你轉檔!ChatGPT一站式處理轉檔工作 ChatGPT在文案寫作、圖像生成、程式碼撰寫等方面的表現令人津津樂道,但它還有一個較不為人知且相當實用的功能:「轉檔」。 ChatGPT轉換多種不同類型檔案格式的品質都很好,有了它幫忙,我們就不必在各種軟體之間疲於奔命了! 【STEP 1】快速掌握20種ChatGPT轉檔功能 轉檔工作雖然不起眼,卻幾乎無所不在。無論是將文件轉換成適當的格式備份,還是將數據轉為兼容格式以供特定軟體處理。 此外,檔案的分割與合併也是常見的行政工作。在這些瑣碎繁雜的工作項目上,ChatGPT能幫上忙的地方比我們想像中更多。 以下列出7大類、超過20種轉檔相關的任務情境,每一項ChatGPT都能迅速完善地交付成果。 ChatGPT轉檔轉檔任務情境文字檔案轉換● Word檔案(.docx、.doc)、純文字文件(.txt)以及Markdown文件(.md)相關的檔案格式轉換。數據資料檔案轉換● Excel 檔案(.xlsx、.xls)、CSV 檔案(.csv)、JSON格式以及XML格式相關的檔案類型轉換。圖片檔案轉換● JPG、PNG、BMP等圖片檔案的格式轉換。PDF檔案分割與合併● 依照特定頁數範圍分割。● 奇數頁偶數頁分別獨立存放。● 單獨提取特定頁數。● 將多份檔案合併為一份。音訊檔案轉換、分割與合併● 不同音訊檔案(.mp3、.wav、.flac)的格式轉換。● 將一份音檔按照指定的時間區段,分割為幾個獨立的檔案。● 合併多份音檔。影片檔案分割與合併● 將影片檔案(.mp4、.avi、.mov、.mkv)按照指定的時間區段,分割為數個小片段。● 按照指定的檔案大小分割。● 將多段影片拼接成一個完整的影片。其他實用功能● 將彩色圖片轉換為灰階。● 圖片尺寸縮放。● 在圖片上套用簡單的濾鏡效果,比如復古風格或是負片效果。● 在圖片上的特定位置添加浮水印或是時間戳記。● 根據指定的排列方式,將多個圖片合併為一張圖。● 壓縮圖片以降低檔案大小。● 將網址製作成QR Code。 問題:ChatGPT可以轉檔影片嗎? 看完以上五花八門的功能或許有人會好奇:ChatGPT可以圖片轉檔,音樂轉檔,但是沒辦法將影片轉檔嗎? 答案是可以,但是失敗率高,限制也多。 原因在於影片的檔案容量通常比較大,轉換過程更為複雜又耗時,在處理中常常因為時間限制或網路不穩定,導致轉檔中斷而失敗。 根據經驗,目前ChatGPT只適合處理容量小、時間短的影片轉檔工作(分割與合併功能則不在此限),但相信AI科技一日千里,未來用ChatGPT處理幾小時長的影片不會是夢。 介紹完ChatGPT擅長的轉檔工作之後,接著就要設計指令囉! 【STEP 2】設計ChatGPT轉檔指令3大重點 工作上轉檔有很多情況,對ChatGPT下的指令也會各不相同。整體來說,轉檔指令可以簡化為3個重點:「輸入什麼、設定條件、輸出什麼」。 以切分一個PDF檔案為例。 輸入什麼:這份PDF檔案。 設定條件:照著1-5頁、6-10頁、10-15頁的順序分割。 輸出什麼:3份檔案。 將這3個重點整合成一段話就是:「請將這份PDF檔案依照1-5頁、6-10頁、10-15頁的順序,分割為3份獨立的檔案。」 透過這樣的方式,我們就能快速將工作需求轉為ChatGPT可以理解的指令,不必多費心力來思考指令該怎麼寫。 值得一提的是,如果要同時處理多份檔案,例如合併好幾份PDF文件,該如何告訴ChatGPT誰在前、誰在後呢? 這裡有個實用小技巧:「將每個檔案的名稱改為數字」,就能直接用數字檔名告訴ChatGPT排列順序囉! 【STEP 3】出現缺頁或文字亂碼?讓ChatGPT修正錯誤 如果發現轉檔後的檔案出現缺頁或是文字亂碼等錯誤,只要請ChatGPT重新處理一次即可排除問題。 舉例來說,近期ChatGPT處理JSON與XML兩種資料格式時,比較容易出現中文字亂碼。這時候我們可以輸入指令:「請修正這份檔案的中文編碼問題,並確保所有資料按照正確的格式顯示」,ChatGPT就會自動修正錯誤。 【STEP 4】下載檔案 轉檔完成後,點擊ChatGPT提供的下載連結,就能儲存檔案。 唯一要注意的是,下載連結有時效性,最好立刻將檔案儲存到自己的電腦。連結若是逾期失效,轉檔成果都會付諸流水! 【技巧升級】快速下載多個檔案的訣竅 當我們連續處理了好幾個轉檔,ChatGPT生成許多不同的下載連結,如果想簡化下載步驟,我們可以告訴ChatGPT:「將所有成果打包成壓縮檔」,就不需要手動下載多個檔案,省了許多麻煩。 節錄自:商周出版《30個必學的AI行政工作術:搞定會議、行程、簡報、文書、圖表、影音、資料庫,事半功倍,準時下班!》/賴彥廷 著 更多【AI工作術】推薦給你: 4步驟學會運用AI關鍵能力!16種AI工具應用解析|行銷策略指令範例 用AI快速寫Email!ChatGPT Writer、Copilot等中英文電子郵件生成 ChatGPT一鍵生成簡報!Slides Maker讓AI幫你快速做完整簡報 會議紀錄用AI怎麼做?會議逐字稿如何整理?|AI語音轉逐字稿教學 用ChatGPT準備面試練習!AI履歷撰寫和模擬面試必學指令
【104職場力】・AI

Google Gemini Omni是什麼?一句話就能生成影片?4功能亮點一次看!

Google推出全新多模態AI模型Gemini Omni,首發Omni Flash可用圖、文、影、音任意組合生成高品質影片,還能用聊天的方式改片,職場力帶你一次看懂功能、官方實測亮點與職場應用,看這款AI如何成為上班族翻倍工作效率的數位特助! 文/《104職場力》 本文導覽 Gemini Omni是什麼?它厲害在哪?Gemini Omni Flash 4大功能一次看功能1:用「對話」就能編輯影片,AI會記得你前面說過什麼功能2:不只「做得像」,還「想得通」功能3:圖、文、影、音任你丟,AI自己會揉成一支片功能4:可用虛擬化身Avatars做出另一個自己怎麼分辨是不是AI做的影片?誰可以用Gemini Omni?開放對象與使用平台Gemini Omni對工作與學習的影響? 過去拍一支影片,要拍、要剪、還要後製,現在Google表示:「跟AI聊天就好」。 Google宣布正式推出全新多模態AI模型「Gemini Omni」,並率先釋出第一款模型Gemini Omni Flash,它能將圖片、音訊、影片、文字任意混搭作為輸入,生成高品質影片,還能透過聊天編輯內容。 這篇就帶各位一次看懂它能做什麼、誰能用,以及對職場工作者的意義。 https://www.youtube.com/watch?v=KUyRq7szZsM Gemini Omni是什麼? Google從一開始就強調Gemini是「原生多模態」打造而成(文字、圖像、聲音、影片從底層就一起處理),去年推出的Nano Banana把這份能力延伸到影像生成與編輯,官方資料指出已幫助數百萬使用者修復老照片、把草圖變成設計、實現過去想像不到的創意。 而這次的Gemini Omni,Google 的定位是:一款結合Gemini邏輯推理與創作能力的全新模型,能以任何輸入素材創造出任意形式的內容,並率先支援影片生成。用白話來說就是:你給它什麼都可以,Gemini Omni會先想清楚,再幫你做出來。 首波釋出的版本,是Omni系列中的第一款模型「Gemini Omni Flash」,今天起開始導入Gemini應用程式、Google Flow與YouTube Shorts,Google也說明,未來會逐步支援圖片與音訊等更多元的輸出形式。 它厲害在哪?Gemini Omni Flash 4大功能一次看 功能1:用「對話」就能編輯影片,AI會記得你前面說過什麼 過去用AI改片最頭痛的是「設定跑掉」的問題,一旦換個角度,角色就變另一個人,或改個動作背景就不一樣,超困擾。 Google強調Gemini Omni改掉這個毛病了!它讓使用者能用最自然的對話編輯影片,而且每一次指令都會承接上一步的脈絡,達到以下效果: 角色外觀保持一致性 場景擁有合理的物理邏輯 場景會記住前一幕發生的細節 依官方提供的情境,使用者可以這樣玩: 改變眼前的世界:針對畫面中的特定物件微調,或是徹底抽換整個世界背景。 重新想像動作與情節:上傳一段拍好的影片,直接要求Omni改變其中的情境。 反覆微調影片細節:調整環境、視角、風格甚至是某個小細節,仍能保留影片原始場景的連續性。 這些功能幫助需要產出社群、行銷、教學影片的工作者省下大量重複生成時間。 功能2:不只「做得像」,還「想得通」 Google特別強調,Gemini Omni不是只把畫面做得逼真就好,它會推理「接下來該發生什麼事」,把對物理現象的理解,結合Gemini對歷史、科學與文化知識,拉近「擬真畫面」與「深刻敘事」之間的距離。 這功能的優點具體展現在3個面向: 更符合真實物理法則:對重力、動能、流體力學的理解大幅提升。 融合知識與創意:超越單純的模式比對,在語言、影像與背後的深層意涵之間建立更深的理解,例如官方示範:A到Z字母短片,每個字母搭配一件不尋常的物品(C配水豚、D配迪斯可球、L配熔岩燈),全程搭配舒緩音樂。 複雜概念視覺化:只要簡短的提示詞,就能做出生動的解說影片,例如:黏土動畫風格、定格動畫等,對需要備課、做簡報的使用者來說是福音。 Google指出,它不只讓影片「好看」,還要「好看的有道理」。 功能3:圖、文、影、音任你丟,AI自己會揉成一支片 這也是Gemini Omni名字裡Omni(全面)的精神,官方說明它能將圖像、文字、影片、音訊等任何參考來源,揉合轉化成一個風格連貫的影片成品。 實際用法如下: 可參考任何東西:例如同時丟一張圖、一段影片、一段音樂,AI會把3者融成一支「畫面隨音樂節拍亮起、風格在多種視覺中切換」的科幻短片。 從手邊的素材開始:使用者可以用既有的角色圖、場景圖,甚至是手繪草圖當作參考,創作出符合心中想像的作品。 套用風格、動態或特效:可以用一段影片提供動作參考,再用另一張圖提供材質風格,Omni會融合所有輸入產生一致的成品。 小提醒:在音訊輸入這塊,Google初期先開放語音檔作為參考素材,其他類型的音訊輸入之後才會陸續加入。 這代表創作者可以用更接近導演工作流的方式來使用AI:先選好角色、選好風格、決定動態,再交給模型完成。 功能4:可用虛擬化身Avatars做出另一個自己 Google同步推出虛擬化身(Avatars)功能,讓使用者可以建立一個數位版本的自己,並生成無論在外貌或聲音上都極具個人特色的影片。 Google這次採取較謹慎的開放策略:一開始可以用虛擬化身製作具有個人特色的影片,至於進一步編輯影片以修改音訊和語音的功能,Google表示仍在持續測試與評估。 對需要做個人簡報、教學影片、社群短片,或經營個人品牌的工作者來說,這是「不用補妝、不用打燈、不用重錄第17次」的解方。 怎麼分辨是不是AI做的影片? AI影片越逼真,真假難辨的疑慮就越大,對此Google的做法是:所有由Omni創作的影片,都會包含無法以肉眼察覺的SynthID數位浮水印。 使用者可以透過以下3個管道,驗證一支影片是否由Gemini Omni生成: Gemini應用程式 Chrome瀏覽器中的Gemini Google搜尋 對職場與學習者來說,這呼應了一個越來越重要的觀念:「會用AI」跟「能辨識AI」是同等重要的兩種素養。 誰可以用Gemini Omni?開放對象與使用平台 Gemini Omni Flash自發表當天起陸續開放,依使用者身份不同有不同入口: 對象入口何時可以用Google AI Plus、Pro、Ultra 方案訂閱用戶Gemini應用程式、Google Flow即日起搶先體驗一般使用者(免費)YouTube Shorts、YouTube Create應用程式本週起免費體驗開發人員與企業客戶透過API接入接下來幾週內陸續開放 這次無論付費與否,幾乎所有人都能玩到,只是開放時間不同,且初期仍有額度限制。 Gemini Omni對工作與學習的影響? 雖然Google官方並沒有特別針對「職場」與「學習」額外說明什麼,但小編統整,至少有4件事情值得大家先放在心上: 影片製作門檻被打掉一大層:過去要拍、要剪、要後製,現在一句話可以生成,對需要產出社群、行銷、教學素材的人,這是直接可用的生產力工具。 「解說型內容」會變得超容易做:模型能把複雜概念視覺化,未來舉凡教育工作者、知識型創作者、企業內訓講師都可以請AI把概念畫出來,當作備課流程的一環。 更方便經營個人品牌:透過虛擬化身(Avatars),不必每次都實際出鏡也能維持個人形象的一致性。 「用語言精準描述畫面」成為新核心能力:過去談prompt工程,現在則延伸到「能不能把腦中的畫面講清楚」,這對學習者是值得從現在開始練的能力。 如果你是內容工作者、影音創作者、簡報常勝軍,或單純想跟上AI工具的新一輪節奏,現在就是試試看的好時機,不一定要馬上做出什麼大作,但去摸一摸、體會一下跟AI聊天就能生影片是什麼感覺,會對未來的工作方式更有畫面。 (影片、資料來源:Google台灣官方部落格) 延伸閱讀: Gemini生圖告別中文亂碼!Nano Banana Pro正式登場,哪些版本能用? AI生圖再進化!ChatGPT Images 2.0生成海報文宣、手繪風塗鴉怎麼做?文字告別亂碼、排版調整實測
【104職場力】・AI

【PPT轉影片】不用剪輯軟體!ChatGPT把簡報變影音,腳本、AI旁白、字幕一次完成|AI念錯字怎麼修?

用ChatGPT把簡報變成有聲影片!作者示範如何用ChatGPT Work將PowerPoint簡報轉成影片,從腳本規劃、AI中文旁白到字幕製作,搭配edge-tts與FFmpeg輸出MP4,並提供各階段提示詞與檢查重點,教你解決中文旁白讀錯問題。本文節錄自《ChatGPT AI Agent 工作術》。 文/施威銘研究室 本文目錄(點擊可快速前往) 【簡報影片腳本】讓簡報動起來!快速打造影片腳本【簡報影片旁白字幕】自動產生簡報AI旁白與字幕【簡報影片合成】用FFmpeg把畫面、旁白、字幕一次合成 【本文使用工具】● 桌面版ChatGPT:切換至Work模式(免費版帳戶目前可以透過桌面版使用Work模式,但無法透過網頁版及手機版使用。)下載ChatGPT Windows桌面版>>● edge-tts:文字轉語音工具,使用Microsoft Edge的線上語音服務,將文字轉換成AI語音與字幕檔,支援多種語言及聲音,也能調整語速、音量與音高。● FFmpeg:免費且開放原始碼的影音處理工具,可以將影片、音檔及字幕合成為完整影片。支援多種影音格式,也能控制解析度、字幕及聲畫同步。 編按:作者示範「簡報轉影片」流程的3個階段:先決定影片方向與腳本,再產生AI旁白與字幕,最後用FFmpeg把畫面、旁白、字幕合成一支MP4。示範素材是一份SBIR補助申請說明簡報,換成你自己的簡報也適用。 【簡報影片腳本】讓簡報動起來!快速打造影片腳本 有些時候,我們無法在現場或是線上簡報,如果能夠把簡報搭配講稿轉換成簡報影片,就可以代替我們進行簡報。簡報轉成影片時,需要重新選擇重點、加快節奏,並在開頭先說出值得繼續觀看的理由。 這個範例會依內容、觀眾與發布情境決定片長。ChatGPT會先提出影片製作方向,確認後再把簡報改編成場景、旁白、動畫與字幕都能銜接的影片腳本。 請先儲存檔案後關閉PowerPoint,並回到ChatGPT Work輸入下方提示詞: 提示詞 請依簡報規劃影片製作方向,說明核心訊息、片長節奏及開場方式,本階段僅討論方向,不製作腳本、語音或影片。 確認核心訊息的內容是否正確(圖/旗標科技《ChatGPT AI Agent 工作術》) ChatGPT會自動判斷簡報內容可以拆成幾個部分,並建議影片片長(圖/旗標科技《ChatGPT AI Agent 工作術》) 也會根據簡報內容,建議影片的開場方式(圖/旗標科技《ChatGPT AI Agent 工作術》) 若有片長的限制,可以直接說明想要呈現的影片長度: 提示詞 片長我想要限制在10分鐘以內。 ChatGPT會自動調整每個部份的長度,讓總長度控制在所需時間內(圖/旗標科技《ChatGPT AI Agent 工作術》) 建立影片腳本 規劃方向確認後,再建立腳本。影片旁白以補充畫面為主,畫面與動畫則延續前面簡報的設計原則。 提示詞 請規劃16:9橫式簡報影片腳本,將內容濃縮為自然口語旁白,以補充畫面為主,不逐字朗讀或增加未確認資訊。每個場景須列出使用畫面、完整旁白、語意區塊動畫順序、秒數及累計時間。前3幕應迅速提出問題或價值,結尾須總結完整結論。請先提交腳本確認,不要製作其他任何檔案。 這邊以第一幕為例,檢查腳本裡的旁白是否自然、呈現秒數是否合理(圖/旗標科技《ChatGPT AI Agent 工作術》) 【簡報影片旁白字幕】自動產生簡報AI旁白與字幕 必備工具 edge-tts:文字轉語音工具,使用Microsoft Edge的線上語音服務,將文字轉換成AI語音與字幕檔,支援多種語言及聲音,也能調整語速、音量與音高。 檢查edge-tts工具 請ChatGPT Work檢查edge-tts是否可以使用,部分電腦可能已經有內建安裝,因此我們先檢查是否有edge-tts可以使用,如果沒有的話,會同步自行安裝並檢驗安裝狀態。 提示詞 請檢查目前環境是否可以使用edge-tts,若尚未安裝,請自行完成安裝。請勿修改簡報或腳本。若需授權或操作,請以簡單易懂的方式說明。完成後回報edge-tts及臺灣中文語音zh-TW-HsiaoChenNeural是否可用,請勿產生完整旁白。 zh-TW-HsiaoChenNeural是Microsoft免費提供的臺灣繁體中文女性AI語音。其中zh-TW代表台灣中文,HsiaoChen是聲音名稱,Neural表示使用神經網路合成語音,適合製作自然、清楚的中文旁白。 產生旁白試聽 先選擇一段同時包含中文、英文、數字或百分比的文字製作試聽,就能集中檢查專有名詞、金額及符號是否讀得自然。 提示詞 請從腳本選取一段含中文、英文、數字或百分比的內容,以edge-tts的zh-TW-HsiaoChenNeural預設語速製作約15~20秒的旁白,並檢查英文、金額、百分比及專有名詞發音。僅提供試聽音檔與文字,請勿製作完整旁白或影片。 播放試聽,檢查中文、英文、數字與專有名詞發音(圖/旗標科技《ChatGPT AI Agent 工作術》) 播放音檔後,如果某個專有名詞讀錯,可以直接把正確讀法寫成容易發音的文字,並要求只重做試聽,待聲音、語速與發音都確認後,才進入完整輸出: 提示詞 請將Phase 1發音念作英文的Phase one,不要用中文念法的1 【簡報影片合成】用FFmpeg把畫面、旁白、字幕一次合成 為了可以讓畫面、旁白、字幕同步對齊,我們會請ChatGPT Work使用FFmpeg為所有素材進行剪輯,並同時檢查素材、字幕與旁白內容,再輸出成MP4影片檔案。 必備工具 FFmpeg:免費且開放原始碼的影音處理工具,可以將影片、音檔及字幕合成為完整影片。支援多種影音格式,也能控制解析度、字幕及聲畫同步。 畫面、旁白、字幕一次合成 輸入下方提示詞後,ChatGPT Work會先檢查3個素材的長度及字幕時間碼,再使用FFmpeg合成。 【提醒】在這個範例中,ChatGPT Work會配合影片旁白與動畫出場時機,自動調整動畫並透過PowerPoint輸出影片。根據實際測試,若未將ChatGPT Work的權限設定為代我核准以上,可能會卡在操控PowerPoint轉出影片的步驟,無法順利完成操作,請記得先設定權限再輸入提示詞。 提示詞 檢查目前環境是否可以使用FFmpeg,若尚未安裝,請自行完成安裝。請複製原簡報後,以既定旁白、動畫、edge-tts與FFmpeg製作1920×1080影片,原檔不得修改。動畫須使用PowerPoint原生物件動畫,依旁白逐項出現並略早於對應關鍵詞;不得將整頁轉成圖片或以FFmpeg動畫取代,FFmpeg僅用於影音、字幕及格式處理。字幕採旁白原稿、系統預設的繁體中文黑體、置於下方安全區、ASS樣式的Fontsize=48、黑底白字、最多兩行,不得自行換算或更改字號,黑底不得重疊。完成同步及播放檢查後,交付有字幕與無字幕MP4,以及SRT檔。 SRT為常見的字幕檔格式,內容包含字幕文字及顯示時間,可以匯入到影片工具進行編輯。 ASS是一種進階字幕格式,可設定字體、字號、顏色、黑底、位置及行距等外觀,但是在匯出成字幕檔時,通常我們會選擇相容性較高的SRT。 若提示詞未明確指定ASS樣式的Fontsize=48,ChatGPT Work有時會以PowerPoint的字級為標準,而不是採用ASS樣式的字級。由於兩者使用的格式單位不同,換算的結果可能不一致,導致產生的字幕大小有所差異。因此,建議直接在提示詞中指定ASS樣式的Fontsize=48,以確保字幕尺寸一致。 在這個步驟中,我們會先請ChatGPT Work複製一份簡報檔,再以副本製作影片。由於影片製作過程中,動畫的出現時間需要配合語音旁白與字幕進行調整,為了避免影響原始簡報的內容與設定,因此會先建立副本,再進行後續編輯。 若ChatGPT Work出現這樣的回覆,請依照它的說明進行操作: (圖/旗標科技《ChatGPT AI Agent 工作術》) 成功交付有字幕影片、無字幕影片,以及SRT檔。 滑鼠左鍵點擊,會在 ChatGPT Work右側開啟影片預覽(圖/旗標科技《ChatGPT AI Agent 工作術》) 有字幕的MP4檔案是指字幕已直接嵌入影片畫面中,因此播放時不用載入外部字幕檔,字幕仍會正常顯示(圖/旗標科技《ChatGPT AI Agent 工作術》) 播放時,除了確認能聽見聲音,也要檢查: 字幕是否與旁白一致,沒有提早跳到下一句 兩行字幕是否完整顯示 旁白音量是否穩定,沒有爆音或突然變小 影片結尾是否保留最後一句與最後一幕 雖然直接使用有字幕的影片 (又稱內嵌字幕)觀看很方便,但是影片調整彈性較差,無字幕影片搭配獨立字幕檔,可以保留後續修改與新增多語言版本。 【補充】字幕檔以SRT檔案格式的相容性較高 字幕檔案有很多種,SRT檔案格式的相容性較高,能在不同的作業系統與播放器中使用,它實際上是純文字檔,下圖就是本例生成的字幕檔: (圖/旗標科技《ChatGPT AI Agent 工作術》) 以Windows內建的媒體播放器為例,可如下步驟匯入字幕:點擊語言和字幕圖示、選取選擇字幕檔案後在交談窗中選用剛剛生成的字幕檔。 (圖/旗標科技《ChatGPT AI Agent 工作術》) 不同媒體播放器的字幕匯入功能位置會有所不同,但匯入的方法都類似,有些會自動讀取與影片相同檔名的字幕檔。 目前Windows內建的媒體播放器尚無法更改字幕樣式,預設會顯示透明底白字,在白底的投影片上會看不到字幕。SRT檔案本身不會包含字幕樣式,需要靠媒體播放器自行調整,若需要調整字幕樣式,建議可以下載第三方播放器進行使用,例如:VLC media player。 影片雖然已經完成,但在正式使用前,還可以讓ChatGPT Work再做一次完整的節奏與同步檢查,避免有人工檢查疏漏的部分。 節錄自:旗標科技《ChatGPT AI Agent 工作術:87 個職場實作範例 | ChatGPT Work × Plugins × Skills》/施威銘研究室 著 推薦閱讀: 用ChatGPT Work整理名片、簽到表!建立Excel聯絡人清單,統一格式、合併重複資料 ChatGPT怎麼整理Excel資料?清理欄位、統一格式,樞紐分析不出錯|8組提示詞範本 Obsidian知識庫怎麼建立?搭配ChatGPT快速整理筆記、串聯零散資料
【104職場力】・AI

有任何收穫或想分享的,都來和大家一起聊聊吧!