2/7 Midjourney Office Hours 回顧:V6 即將升級 Beta 版本、V7 版本開發進行中

在2月7日的 Midjourney 辦公時間中,Midjourney 宣布了一系列即將到來的更新和發展,這些更新將影響其人工智能驅動的視覺內容創建平台。以下是回顧和展望 Midjourney 未來版本的關鍵點。

首先,Midjourney 正在清理其 Alpha 網站的創建流程,計劃在下周開放給生成超過1000張圖像的用戶。此外,團隊正著手開發下一版本的網站,將引入更多社群功能,儘管具體細節尚屬未知。隨著新功能的加入和網站外觀的改善,他們將添加入門教程和教育內容。

關於 V6 版本,Midjourney 即將將其轉為 Beta 版本,並將其設為默認版本。這一更新將帶來性能提升、更高的圖像一致性和更佳的紋理表現,例如草地的紋理。此外,還可能進行輕微的美學更新。

Midjourney 還介紹了改進的“ Describe ”功能,旨在提供更貼近用戶想要的圖像的提示。這一功能預計在本周或下周初推出。另外,團隊開始著手於角色一致性的工作,這是社群最期待的下一個功能,預計需要幾周時間才能完成。

針對 Niji 6 ,Midjourney 計劃在下周推出區域變化功能。而對於 V6.1 ,團隊正在探索一種不同於默認 Midjourney 模型的個性化選項,稱之為“模型調節器”,可能將此更新命名為 V6.1。

除此之外,Midjourney 正著手於 V7 版本的開發,這一版本預計會在幾個月後推出,將帶來更好的像素圖像質量和細節改進,讓小物件在不產生人工痕跡的情況下看起來更好。

最後,Midjourney 團隊也在開發視頻功能,但這還需要一段時間。團隊還概述了社群反饋清單中的頂級需求,包括角色一致性、對用戶自己的圖像進行內部填充的能力、更好的風格和相機控制、圖像刪除(將有隱藏圖像的選項)、改善遠處物體的呈現,以及在 V7 版本中提高圖像質量。

這些更新和開發計劃反映了 Midjourney 對於不斷進步和滿足其廣大用戶需求的承諾。隨著這些計劃的實施,Midjourney 將繼續推動視覺內容創作的界限,為用戶提供更加強大和個性化的創作工具。

Google Bard 全球更新:Gemini Pro 現在支援 40 種語言

圖片由 Bard 生成

Google Bard 宣布進行全球更新,將 Gemini Pro 大語言模型(LLM)功能擴展到 40 種語言,並為其添加圖像生成功能。此更新將使 Bard 能夠為更多用戶提供服務,並使其能夠生成更具創意和信息量的內容。

Gemini Pro 是 Google 目前最先進的大語言模型,它經過訓練,可以生成人類質量的文字。Gemini Pro 可用於各種任務,包括回答問題、生成創意內容、翻譯語言和撰寫不同類型的文字。

此次更新將 Gemini Pro 功能擴展到 40 種語言,包括中文、英文、法文、德文、西班牙文、日文、韓文、葡萄牙文、俄文和義大利文。這將使 Bard 能夠為全球更多用戶提供服務。

「我們很高興宣布 Bard 的此次全球更新」, Google AI 研究科學家 Blaise Agüera y Arcas 說。「Gemini Pro 的擴展和圖像生成功能的新增將使 Bard 成為更強大、更具多功能性的工具。」

Google Bard 的此次全球更新將使其成為更強大、更具多功能性的工具。Gemini Pro 的擴展將使 Bard 能夠為更多用戶提供服務,而圖像生成功能將使 Bard 能夠生成更具創意和信息量的內容。

Google Bard 新增圖片生成功能

Google Bard 是一款大型語言模型,以其生成文字、翻譯語言、撰寫不同類型的創意內容以及以翔實方式回答問題的能力而聞名。近日 Google Bard 新增了一項新功能,允許使用者生成圖片。這項創新的功能由 Google 最新推出的 Imagen 2 模型支援,為創意表達和溝通開啟了無限可能。

運作方式

使用者可以輸入描述所需圖片的文字提示來存取圖片生成功能。然後,Bard 會利用其對語言的理解和對世界的認知來創建與提示相符的獨特圖片。例如,使用者可以提示 Bard “生成一隻戴著帽子的貓的圖片”,Bard 會生成一隻戴著時尚帽子的貓的圖片。

Imagen 2:賦予逼真創建能力

圖片生成功能由 Imagen 2 模型支援,Imagen 2 是 Google AI 推出的下一代模型。Imagen 2 經過專門設計,可生成高品質、逼真的圖片。它經過大量文字圖片對的訓練,能夠捕捉人類語言的細微差別並將其轉化為視覺震撼的圖片。

超越基本圖片

Bard 的圖片生成功能不僅限於簡單的物件創建。使用者還可以為圖片指定風格、情緒甚至品牌指南。這允許高度的定制和控制,使 Bard 成為設計師、行銷人員和任何想要創建獨特視覺內容的人的寶貴工具。

安全和負責任的使用

與任何強大技術一樣,負責任地使用 Bard 的圖片生成功能非常重要。Google 已採取措施降低濫用的可能性,例如禁止生成暴力或性暗示內容。此外,Bard 使用水印技術 SyntID 來識別由模型生成的圖片,幫助防止錯誤資訊的傳播。

Bard 的未來

新增圖片生成功能是 Bard 發展歷程中的重要一步,使其成為一種更通用、更強大的創意表達和溝通工具。隨著 Google 繼續開發 Bard 及其底層技術,可以期待未來會推出更加令人興奮的功能和功能。

其他注意事項
  • Bard 的圖片生成功能目前僅提供英文版本,預計未來會推出其他語言版本。
  • 個人和非商業用途的該功能是免費的。
  • 目前僅支援正方形,輸出尺寸1536×1536。Bard 對於指定大小的指令還不是很聽話,所以指定的尺寸很有可能不是使用者想要的那個尺寸。
  • 可以生成圓形、橢圓形、心形等圖像,但是外框仍然是正方形。
  • 目前無法產生人物圖像,Bard 回覆它仍處於開發階段,生成的人物圖像可能會被濫用來創建有害內容。

實際測試

使用者輸入

Draw a realistic photo: Naraji Temple in Kyoto, sparse deer grazing, natural light, sunlight shining above the temple.

輸出

Sure, here is a realistic photo of Naraji Temple in Kyoto, sparse deer grazing, natural light, sunlight shining above the temple:

不管是構圖、細節的呈現、成像品質跟主流 AI 圖像工具如 Midjourney 、 DALL-E 3、Microsoft Designer、 Stable Diffusion 等仍然有非常大的差距。

其他形狀

圓形

橢圓形

心形

Google 將於 3 月 12 日更新核心 Web Vitals,並與 Next Paint (INP) 進行交互

Google 宣布將於 2024 年 3 月 12 日更新核心 Web Vitals 指標,並將首次輸入延遲 (FID) 替換為與下一次繪製的交互 (INP)。INP 是一種新的指標,用於衡量用戶與網頁互動後,網頁內容更新的速度。

INP 的定義與重要性

INP 代表「與下一次繪製的互動」,是一種新的 Google 核心 Web Vitals 指標,用於衡量導致網站延遲的用戶互動。 INP 測試衡量用戶與網站互動(例如點擊某物)和內容在視覺上更新以響應之間需要多長時間。 這種視覺更新稱為“下一次繪製”。 例如,用戶可能會在網站上提交聯絡表單、點擊按鈕或選擇在燈箱中開啟的圖像。 INP 測試將衡量用戶執行這些互動和實際看到網站上的更新內容之間所花費的時間。

然後,Google 測試會根據網站上大多數用戶互動的持續時間得出一个 INP 分數。分數將為“好”、“需要改進”或“差”,取決於網站在視覺上更新所需的時間。

INP 分數很重要,因為它可以反映網站對使用者輸入的反應速度。 如果 INP 分數較低,則表示網站對使用者輸入的反應速度較快,這會為使用者帶來更好的體驗。

INP 與 FID 的比較

INP 取代了 FID 成為核心 Web Vitals 指標之一。 FID 代表「首次輸入延遲」,也是一種用來衡量網頁互動性的指標。 FID 測量使用者首次與網頁互動(例如點擊按鈕或輸入文字)後,瀏覽器開始處理事件所需的時間。

INP 與 FID 的主要區別在於,INP 會考慮網頁的渲染時間。 因此,INP 分數通常會比 FID 分數更高。 此外,INP 會測量所有使用者互動的時間,而 FID 只會測量第一次使用者互動的時間。 因此,INP 可以更準確地反映出網頁的整體互動性。

如何改善 INP 分數

網站管理員和開發人員可以採取以下措施來改善 INP 分數:

  • 減少 JavaScript 的使用
    • JavaScript 可以讓網頁更加動態和互動,但它也會增加網頁的載入時間和複雜性。 過多或不必要的 JavaScript 會導致 INP 分數下降。
  • 優化 CSS 的使用
    • CSS 可用於控製網頁的版面和樣式。 過多的 CSS 規則會增加網頁的載入時間,並導致 INP 分數下降。
  • 使用圖像壓縮
    • 圖像文件通常是網頁上最大的文件類型。 壓縮圖像可以減少它們的尺寸,並加快網頁的載入速度,從而提高 INP 分數。
  • 啟用瀏覽器緩存
    • 瀏覽器緩存可以儲存網頁的靜態資源,例如圖像和 JavaScript 檔案。 啟用瀏覽器快取可以減少重複下載這些資源所需的時間,並提高 INP 分數。

INP 更新對 SEO 的影響

Google 將 INP 納入核心 Web Vitals 指標,意味著 INP 分數將成為 SEO 排名的重要因素。因此,網站管理員和開發人員應採取措施改善其網站的 INP 分數。

結語

Google 更新核心 Web Vitals 指標,旨在為使用者提供更好的網頁體驗。INP 的更新將有助於網站管理員和開發人員更有效地衡量和改善網頁的互動性。

以下是改善 INP 分數的其他建議:

  • 使用性能分析工具來監控網站的 INP 分數。
  • 進行 A/B 測試以找出哪些優化措施可以對網站產生最大的影響。
  • 遵循 Google 的最佳做法來改善網頁性能。

通過採取這些措施,可以提高網站的 INP 分數,並為用戶提供更好的體驗。

Midjourney 最新更新:引入「一致風格」功能,增強藝術生成體驗

2024年2月1日,Midjourney 發佈了其首批測試算法,用於實現「一致風格」( Consistent Styles )的創作,此功能被稱為「風格參考」( Style References )。這項新功能類似於圖像提示,允許使用者提供一個或多個圖像的 URL 作為描述所需一致風格的參考。 Midjourney 的圖像模型將根據這些風格參考來嘗試創造出與之匹配的美學作品。

使用「風格參考」的方法包括在提示後添加「––sref」標記,並附上一個或多個圖像的 URL 。使用者還可以設定風格的相對權重,以及通過「–sw」指令來調整整體風格化的強度。這項功能支持在 V6 版本及 Niji V6 版本中使用,但不兼容於 V5 等較早版本。 Midjourney 計劃在未來幾週更新此功能,並可能將添加「一致角色」特性,運作方式類似,將使用「––cref」參數。

Midjourney 的這項創新不僅豐富了 AI 藝術創作的可能性,也為藝術家和設計師提供了更多控制創作風格的工具,從而開闢了個性化藝術創作的新途徑​​。

官方使用說明

1. 在提示符號後鍵入 --sref,然後像這樣輸入一個(或多個)圖片 URL --sref urlA urlB urlC

2. 圖像模型會將這些圖像 URL 視為"樣式參考",並嘗試製作出"符合"其美學的圖像。

3. 像這樣設定樣式的相對權重 --sref urlA::2 urlB::3 urlC::5

4. 透過 --sw 100 設定風格化的總強度(100為預設值,0為關閉,1000為最大值)

5. 常規影像提示必須放在 --sref 之前,如下所示/imagine cat ninja ImagePrompt1 ImagePrompt2 --sref stylePrompt1 stylePrompt2

6. 這適用於 V6 和 Niji V6(不適用於 V5 等)。

注意事項

1. Midjourney 可能會在接下來的幾週內更新此功能(可能會有所改變,因此請小心謹慎,因為它還處於 alpha 階段)。

2. 如果提示傾向於寫實主義,而希望使用插圖等與之相衝突的風格,可能仍需要在提示中添加一些文字說明

3. 樣式引用對圖像提示沒有直接影響,只對至少包含一個文字提示的作業有影響。

4. Midjourney 計劃稍後添加"一致的字元"功能,該功能與 --cref 參數的作用相同。

實際測試

我們先使用 Midjourney 產生三張構圖與角色風格類似的圖像。

Prompt: 一個30歲美麗的日本秋田縣女性作家,大眼睛,白皙的皮膚,頭戴米色漁夫帽,身穿米色連身裙。她的右手拿著一本書,左手扶著右手。背景是秋天佈滿楓葉的秋田縣角館武家屋敷大道,自然光,側光。

A beautiful 30 year old female writer from Akita, Japan, with big eyes, fair skin, wearing a beige fisherman's hat and a beige one-piece dress. She is holding a book in her right hand and holding her right hand with her left hand. The background is the autumn maple leaves on Takeshi Yashiki Avenue in Kakunodate, Akita Prefecture, natural light, side light. Medium shot, Leica SL2-S, f/1.8, 35mm, ISO 200. --ar 16:9 --s 500 --v 6.0

參考圖像

接著我們用另一個主角,不同的職業,不設定穿著,不設定相機及光線參數,站在另一個場景測試 sref 參數對後面產生圖像的影響。

Prompt: 一個30歲美麗的日本女性上班族,秋葉原街拍。

A beautiful 30 year old Japanese female office worker, Akihabara street photography. --sref https://s.mj.run/NueRyP4V_No https://s.mj.run/qPAr52EcgTo https://s.mj.run/CJzaw3R1V9U --ar 16:9 --v 6.0

從生成結果我們可以發現使用 sref 參數之後,生成的圖像其人物髮型、輪廓、皮膚與後方的背景皆高度近似參考的範例圖像,相信日後經過官方的持續調整優化,這個參數對於工作上需要創造系列風格圖像的使用者將會是一個十分便利的功能。

其他參數範例

SW 300

A beautiful 30 year old Japanese female office worker, Akihabara street photography. --sref https://s.mj.run/NueRyP4V_No https://s.mj.run/qPAr52EcgTo https://s.mj.run/CJzaw3R1V9U --sw 300 --ar 16:9 --v 6.0

SW 500

A beautiful 30 year old Japanese female office worker, Akihabara street photography. --sref https://s.mj.run/NueRyP4V_No https://s.mj.run/qPAr52EcgTo https://s.mj.run/CJzaw3R1V9U --sw 500 --ar 16:9 --v 6.0

SW 750

A beautiful 30 year old Japanese female office worker, Akihabara street photography. --sref https://s.mj.run/NueRyP4V_No https://s.mj.run/qPAr52EcgTo https://s.mj.run/CJzaw3R1V9U --sw 750 --ar 16:9 --v 6.0

SW 1000

A beautiful 30 year old Japanese female office worker, Akihabara street photography. --sref https://s.mj.run/NueRyP4V_No https://s.mj.run/qPAr52EcgTo https://s.mj.run/CJzaw3R1V9U --sw 1000 --ar 16:9 --v 6.0

相對權重 –sref urlA::8 urlB::1 urlC::1

A beautiful 30 year old Japanese female office worker, Akihabara street photography. --sref https://s.mj.run/NueRyP4V_No ::8 https://s.mj.run/qPAr52EcgTo ::1 https://s.mj.run/CJzaw3R1V9U ::1 --ar 16:9 --v 6.0

2024/6/21官方新增功能

  1. 現在可以將多個 sref 代碼混合在一起(例如--sref 123 456)
  2. 現在可以將樣式參考圖像 url 和 sref 隨機碼混合在一起(例如--sref 123 url)
  3. 可以按此方式加權單個代碼或網址(--sref 123::2 456::1)

如何查詢 Midjourney 的 sref 代碼

要查詢 Midjourney 的 sref 代碼,可以按照以下步驟操作:

  1. 訪問 Midjourney 的官方網站或 Discord 頻道。
  2. 找到想要參考的圖像。這可能是你之前生成的圖像,或是其他用戶分享的作品。
  3. 在圖像下方或相關資訊中,尋找該圖像的唯一 seed 號碼。這個 seed 號碼就是該圖像的 sref 代碼。
  4. 如果你在 Midjourney 的個人頁面上查看圖像,可以直接複製該圖像的 seed 號碼。通常會顯示在圖像的相關資訊中。
  5. 獲得 sref 代碼後,你可以在新的 Prompt 中使用它來生成相似風格的圖像。使用方法是在 Prompt 後加上 --sref [代碼],例如:--sref 1872264792。

請注意,sref 代碼功能是 Midjourney 較新推出的功能,旨在幫助用戶快速複製特定風格來創造新圖像。這個功能對於需要保持一致風格或快速輸出相同風格圖像的用戶來說非常有用。

進一步閱讀
  1. Midjourney 推出模型個人化( Model Personalization )功能
  2. Midjourney 宣佈推出 「探索視覺功能潛在空間」 測試算法
  3. 在 Midjourney 中使用 Triple Triple 技巧創造獨特風格的圖像
  4. Midjourney 推出新版風格參考算法並重啟圖片評分獎勵機制
  5. Midjourney 推出新的「角色參考」測試功能