嗨,大家好。 平常如果我們想要用AI來生成圖片或影片,最常見的方式就是訂閱各種線上的AI平台。 不過這些服務每個月可能都要固定支付10至15美元以上,部分進階的方案甚至更貴。 這對於只是偶爾使用,或是單純想要體驗AI創作的用戶來說,是一個不小的負擔。 因此今天我要向大家介紹一個更具彈性的方式,就是在自己的AI助理, 像是ChatGPT或Cloud 安裝一個Skill技能 讓AI助理能以非常低廉的成本 來生成圖片和影片 不需要綁定任何的訂閱方案 好 那這邊我們首先要下載 Cloud或ChatGPT的桌面板軟體 因為後續我們需要讓AI助理 讀取參考圖片 並且將生成好的檔案 儲存到指定的位置 而如果你習慣使用ChatGPT 你也可以在它的官網首頁 來下載它的桌面板軟體 好 那我以Cloud為例 下載並安裝完成後 你可以直接把桌面板的軟體打開 而這邊我們需要在電腦中先建立一個專案資料夾 你可以隨意找一個位置 利用滑鼠優件執行新增 並取一個自己容易記住的名字 建立好後 我們對著資料夾雙計滑鼠左鍵來將它打開 並且重複剛才的步驟 另外建立兩個資料夾 分別是完成檔和參考圖 之後我們會使用到 資料夾準備好之後 你就可以回到桌面板的软体 来加目前的专案指定到刚建立的资料夹 点击打开 再一下信任此工作区 如果你使用的是ChatGPT 方式也大同小异 你只要把来源资料夹 同样指定到刚才的位置就OK了 好那接下来我们要来到一个叫做Fold的平台 它的优点是提供的AI模型非常的多 且计费方式非常的透明 你可以用自己的Gmail信箱先注册一个账号 登入之后 我们要取得一个叫做API Key的金钥 系统会使用这把金钥来辨识你是哪一位使用者 好 所以我们到右上角点击新增金钥 点击建立 然后你就可以把萤幕上显示的金钥密码拷贝下来 妥善保存在自己的电脑 那FOR不需要你支付固定的月费 而是按照你实际生成的图片数量来计算费用 因此我们必须先绑定一张信用卡 绑定完成后切换到Credit的页面 那一开始其实不需要处置太多 你可以等熟悉操作之后 再试自己的需求来增加额度 而要查看Fore有提供哪些AI模型 你可以到左上角点击探索 如此你就能在页面左侧看到所有的模型分类 例如Text to Image 就是所谓的由文字生成图片 那目前文生图的AI模型 其中最受欢迎的一个 是由Google推出的Nano Banana Tool 那这个页面有提供了一个简单的范例 左侧的Prompt栏位是这张图使用的提示词 然后下面有一个宽告笔的下拉选单 再下来是影像的解析度 而在旁边有一个进阶设定的按钮 你可以在这个区块指定生成图片的数量 以及图档要采用哪一种储存格式 最后在右蓝有一项很重要的资讯 就是在使用nano banana2的时候 费用是如何计算的 你可以把这些资讯做个拷贝 来跟其他AI模型做个比较 譬如目前另一个很热门的AI模型 是GPT Image2 你可以进入它的页面之后 同样找到它的计价方式 把它拷贝下来 然后我们就可以在ChallGPT 把两个模型的价目表贴上去 请它来做个分析 看看哪个比较划算 好那分析的结果 ChaiGPT認為使用nano banana2來生成圖片會比較省錢 所以我打算把它當成主力的模型 接著再回到Fall的官網 將nano banana2的模型ID做個複製 那這邊有個要注意的地方 就是Fall提醒我們 一個模型可能會使用不同的接口來執行不同的任務 以nano banana來說 它有兩個接口 一個是文字生成圖片 而另一個是修改現有的圖片 至於GPT Image Tool 這邊也是一樣的 總共有兩個不同的接口 好 取得了 API 金曜和模型的 ID 之後 我們可以回到 Cloud 準備來建立一個 Scale 技能 所謂技能 你可以把它當成是一個讓 AI 助理閱讀的操作手冊 讓他知道在執行任務時要遵守哪些要點 舉例來說 我們可以告訴 Cloud 只要我們請他生成或編輯圖片 就要啟用這個技能 使用的模型包含了nano banana2和gbt image2 同時要提醒它必須依照任務的類型來選擇正確的接口 那這邊還有一點要特別注意 就是我們剛才取得的API金鑰不要直接貼給Cloud 因為這有可能會讓金鑰隨著對話內容一同曝光到網路上 比較合適的做法是把這類型的機密資訊 儲存在一個叫做.env的檔案 讓程式在執行時自動補取 那最後我們也要在提示詞中說明 如果生成的任務需要用到參考圖 AI助理可以到參考圖資料夾內來存取這些檔案 至於生成好的圖片則統一放到完成檔資料夾 並且以模型名稱加上日記時間來作為檔名 好 那我把這個提示詞貼到輸入框內 並且按下Enter鍵送出 CRAWD有可能會在建立技能的過程中 向我們詢問一些問題 你可以依照自己的需求來進行作答 也可以直接采用它提供的建议 等技能建立完成后 你就可以打开Cloud替我们准备好的.env档案 让大家显示在电脑的资料夹内 接着再将这个档案使用一般的祭祀本开启 来将先前我们取得的API金钥贴到指定的位置 最后再按下Ctrl加S执行储存 好 那我们就来测试一下建立好的技能吧 我请Cloud生成一张图片 主题是一个在古罗马经济上分战的角斗师 然后将提示纸送出 过程中如果跳出授权的对话框 就直接按下允许 于是过了一会儿之后 一张手持鉴钝的角度式图片就生成完毕了 而且图片也已自动储存到先前我们指定的资料夹 OK 那接着我们来试试看 让AI修改现有的图片 举例来说 这里我有一张狮子的图片 我想要让它穿上一套金色的铠甲 我要让Cloud能取得这张图片 我们必须先把图档拷贝起来 进入到专案中的参考图资料夹 然后按下Ctrl加V来将图档贴上 参考图放到定位之后 你可以回到Cloud来撰写生成图片的提示词 如果有需要 你甚至可以请Cloud使用不同的模型各生成一张图片 方便我们对照两个模型输出图片的风格特色 好我们将提示词送出 Sharad片刻后 Cloud便回传了两张生成好的狮子图片 甚至還貼心說明了兩個作品在細節上的差異喔 好 當我們在撰寫圖片提示詞時 常會遇到一個瓶頸 就是我們不知道該如何描述畫面中的細節 像是場景該如何鋪陳 鏡頭視角該如何拿捏等 而這種需要專業知識的任務 其實我們也可以交給AI助理來代勞 就是把原來的技能做個改寫 請納在深層圖片時 先依據我們提供的主題自動補充更豐富的細節 而且修改好後要先讓我們過目 確認沒有問題之後才能送出 OK 技能修改完成後 我們來驗收一下成果 譬如我請Cloud生成一張蘇格拉底 在雅典街頭與別人辯論的圖片 然後將提示詞送出 而這一次Cloud並沒有直接動工 而是先把這個主題擴展成一段內容詳盡的提示詞 包含了人物的神態、周圍的建築 乃至於鏡頭的焦段等全都描述的一清二楚 然後將提示詞送出。而這一次Cloud並沒有直接動工。而是先把這個主題擴展成一段內容詳盡的提示詞。包含了人物的神態、周圍的建築。乃至於鏡頭的焦段等,全都描述的一清二楚。而我們看過覺得沒有什麼問題的話,就可以請Cloud送出。於是很快的,一張生動的蘇格拉底辯論的場景就呈現在我們的眼前。OK,那這個技能不光是可用來生成圖片。如果想要生成影片, 也没有任何问题 我们一样可以回到Ford的网站 在左侧的分类中勾选Text to Video 以目前来说 生成影片效果最出色的模型 首推SeedDance 2.0 而旁边的MiniMax H3 则是前几天才刚亮相的新模型 除此之外 下面还有一个性价比很不错的选择是Clean V3 那同样的 你可以逐一进入这几个模型的页面 把他们的机家资讯拷贝下来 一同交给AI来进行分析和比较 等你选定好众议的主力模型之后 你就可以写一段提示词 请Cloud把影片生成的功能一并加入到原有的技能之中 而由于影片的设定参数较多 而且每个模型的数值都不太一样 因此这边我让Cloud采用一问一答的方式 协助我们来进行设定 好 我将提示词送出 功能一切就绪之后 就可以立即来做个测试 例如我指定用Cream 3.0生成一段影片 让一位穿着时尚的男子朝着镜头走过来 然后拿出一条巧克力棒咬了一口 接着按下Enter键送出 同样的Cloud会根据这个主题先进行提示时的优化 我们看过没有问题之后 Cloud就会开始逐一询问影片参数的细节 包含影片的秒数 篷高比要设为多少 以及是否要生成音讯 全部确认完毕后 Cloud就會開始進行影片的生成 好 我們來看一下生成好的作品 OK 那在生成影片時 有一個很常見的技巧 就是我們先提供一張靜態的圖片 作為初始影格 然後請AI將這張圖片動起來 那我們來看一個例子 譬如這裡有一張圖片 是一名女子将脸颊贴在一条巨大的飞龙头上 而我想要让AI延伸出后续的画面 同样的 我们要先把这张图片做个拷贝 进入到参考图资料夹 按下Ctrl++V来将它贴上 然后我们再回到Cloud的界面来撰写提示词 比如这一次我改用MiniMax H3的模型 让女子抬起头跟飞龙一同看向相机的镜头 并且将镜头逐渐拉远 然后按下Enter键送出 那Cloud同樣會先聽我們優化提示詞的內容 來擴展影片中的細節 接著再向我們主意確認影片的各項參數 包含長度要設為幾秒 解析度要設為多高 確認完畢後 Cloud就開始執行影片生成的任務 於是片刻之後 一段充滿史詩感的奇幻短片就成功產生哦 OK 最後如果你想要讓生成圖片和影片的流程更加順手 我们甚至还可以更进一步 请Cloud 把这个技能改造成一个桌面板的App 由于这是一个比较大的任务 所以你可以把Cloud 先切换成计划模式 接着再来描述我们心目中理想的App样貌 像是视窗版面的布局 想要走什么样的设计风格 面板内应该有哪些栏位和按钮 以及生成好的作品要如何呈现和管理等 把这些想法送出之后 Cloud 会询问我们一些问题 来确认实作的细节 如果你对于技术层面的术语不太熟悉 可以直接采用Target的建议就OK了 细节都确认完毕之后 Cloud会先写一份计划的提案 看过之后如果没有问题 Cloud就会开始着手实作 好那APP目前已制作完成 我们可以把它打开实际来测试一下 首先API金钥的部分 你只要打开设定对话框 就能把金钥贴到栏位里面来做妥善的保存 而在界面的左上角 我们可以自由切换图片和影片两个分页 至于要使用哪一个AI模型 这个透过底下的下拉选单来做挑选 由于这个APP目前还缺少一个专属的图示 所以我们不妨借着这个机会 让APP自己来生成 例如我想要生成一个抽象几何风格 带有圆角造型的白色图示 宽高比的话可以设成1比1 然后按下生成按钮 图示生成完毕后 我们就把它储存到电脑资料夹 并且将它命名为icon 那最后我们就让Cloud 把这个App的外观 套用刚制作好的图示 并且将App安装到应用程式资料夹 如此一来 之后当我们想要生成图片或影片的时候 只要在电脑内打开这个App 就能立即使用 是不是非常的方便呢 OK 那今天关于Cloud生成图片和影片技能的介绍 我们就聊到这边 我们下回再见 拜拜