Bard重磅更新!新增支援圖片生成 以及正式支援 Gemini Pro 模型
Google Bard 在 2024.02.01 迎來了一次重大更新,此次更新新增了 AI 圖片生成功能,以及正式的大範圍支援包括中文等 40 種語言可以使用 Gemini Pro 模型版的 Bard。 Your browser doesn't support HTML5 video. Here
依分類瀏覽所有文章與技術筆記。
Google Bard 在 2024.02.01 迎來了一次重大更新,此次更新新增了 AI 圖片生成功能,以及正式的大範圍支援包括中文等 40 種語言可以使用 Gemini Pro 模型版的 Bard。 Your browser doesn't support HTML5 video. Here
Copilot 最近推出了 Copilot GPTs 的更新,根據微軟官方的部落格說明,未來 Copilot Pro 的付費用戶可以使用 Copilot GPT Builder 自定義建立專屬的 Copilot GPTs。但微軟這次的更新也免費提供了幾
近年來,生成式 AI 的發展速度非常快。除了可以讓文字生成文字、圖片、聲音等,也有一項眾多團隊在研發的技術,那就是用文字生成 3D 模型。 Genie 介紹 今天要跟
今天我要來跟大家推薦一個我覺得蠻有趣的專案,叫做 Hello 算法。 資訊類科系的學生們,基本上都會上到資料結構與演算法的課程,而這個專案提供了一個非常淺
之前我有發一篇文章,內容是介紹如何利用 Colab 訓練一個 Bert-VITS2 模型。但因為時間關係,當時並沒有詳細講解要如何將訓練好的模型部署到 Hugging Face 上。所以這篇文章就是
Bert-VITS2 這個專案是目前複製聲音技術中,算是比較好上手效果又特別好的。我自己也簡單的寫了個 Colab 記事本,讓大家可以更方便的使用這個專案。 而今天也主要會跟
Google 最近推出了全新的 Gemini AI 模型,並號稱多項指標已經超越 GPT-4。雖然其宣傳影片被指出造假,Google 也承認了。但 Gemini 的討論熱度依舊不減。 Google 已將
狀況概述 最近 Chrome 的介面改版了,但分頁選單移到了左上角,讓人非常地不習慣。幸好 Chrome 目前還有允許還原舊版介面的方法,今天就來跟大家介紹一下。 解決方法
現在各種大型語言模型可以說是百花齊放 大多數人的電腦硬體,也應該足夠跑動一些參數較少的語言模型了 但如果說要將這些開源的語言模型,實際應用在專案
最近因為剛好有人問我,要怎麼在 GitHub 上傳超過 100MB 的檔案,所以我就想說拿出來跟大家分享一下。 狀況概述 正常來說,如果是使用 GitHub Desktop,在嘗試 Push 超
在網路上看漫畫時,難免會遇到漫畫還沒有翻譯成中文的狀況。這時如果對該語言不夠熟悉,可能就沒辦法繼續追最新的進度。 而正好,前一段時間有位開發者
最近在製作專案時,使用了一個名為 Vosk 的語音辨識,但目前 Vosk 沒有繁中的模型,只能夠輸出簡體中文,所以我便簡單的土炮了一個簡轉繁的 C# 程式,方便專案使
狀況概述 最近在做 Side Project 時發現 Ace Editor 會有輸入游標無法與目前文字對齊的狀況,如下圖所示: 可以看到這張圖片在右側的部分,新輸入文字的位置,已經與原本文
現在在網路上我們已經可以找到許多開源的語言模型。想要玩一下的話,模型也都可以在 HuggingFace 上找到。這些語言模型雖然大多都可以直接使用 llama.cpp 來跑,但在 CMD 或 Terminal
今天要來跟大家介紹一個名為【video-retalking】的開源專案,這個專案可以讓我們將輸入影片中的人物說話嘴型,改成配合輸入的音檔。是