Mar 2026【隨筆】Clone a Meta Ray-ban Display glasses application|藍芽 L2CAP CoC 極致低延遲架構優化:實現 720p 智慧眼鏡流暢串流 👓(LIVE DEMO)

圖片
最近在做一些實驗性質的東西,記得去年短暫玩過 2023 年底上市的第二代 Ray-Ban Meta 智能眼鏡,雖然它主要還是依賴智慧型手機作為算力中心,但我們對它所使用的串流技術很感興趣,因為聽說他們是用藍芽做串流。 去年曾經有同事隨口問我:「我們的眼鏡做到跟他們一樣你覺得有可能嗎?」,因為我知道我們的硬體規格跟人家的相比並非等號,加上當時有其他事情在搞,所以隨口開玩笑回說:“可是聽說 Meta 有200個人在搞那個眼鏡捏(雖然不知道他們負責搞應用的有幾人),啊我如果一個人可以幹贏他們200人,那我還在這幹嘛???(笑)” 也記得更久以前,當我們還在研究那個眼鏡時,常聽到像是:『 他們不知道用了什麼黑科技 』,這類沒有建設性、不應該從 RD 嘴裡說出來的話,而我也是不以為然。坦白講,以前每次只要聽到某SW嘴砲經理(暫且以H君稱之),沒事就把『 黑科技 』三個字掛在嘴上,當做無知的遮羞布,我就會感到倒胃口!同樣身為RD,我只覺得  Shame on you!(打嘴炮、作秀搶風頭、噁心帶風向、搞政治操作、把別人做事的成果搶去幫自己抬轎、有鍋直接推給下屬扛、散佈同事私生活謠言,還有職場霸凌,這些你他媽都頂級專業戶,除此之外沒啥洨用了!) 一件理論上可以做到的事情,外行人的認知被信息差,不懂加上沒實作能力去驗證,就什麼都變成黑科技了(多黑?比巴西黑鮑魚還黑嗎?)。反重力技術說不定也非啥黑科技,只是政府不讓你普通老百姓了解罷了。 Ray-ban Meta 的黑科技,講白了就是人家拉個百人團隊在搞那支眼鏡,然後把軟體技能和硬體規格點滿,再加上極致優化後的成果罷了! 當時知道 Ray-Ban Meta 的智慧眼鏡有塞入一個強大的 WiFi 6 晶片在裡面,一開始我猜測會不會有可能是透過 WiFi P2P 或 WiFi SoftAP 的方式去做串流(確實 Meta 的智能眼鏡,在同步媒體時,會強制要求開啟手機的 WiFi 開關,所以媒體同步應該是靠 WiFi 通道做的),而去年初我也快速做了一個WiFi Direct 架構來做 POC,確實傳輸效率非常快,幾百 MB 的大檔幾乎秒級傳完,從眼鏡端將媒體串流到手機端更是不用說的順暢,而且當時我們的媒體串流還是以未經編碼的方式傳透過 Socket 直接傳輸的(這表示傳輸時所需的頻寬會更大,功耗據說也較大)。 後來因為 ...

試玩一下 Google 推出的 Gemini 2.5 Flash Image 圖像生成模型|一鍵生成超擬真3D公仔

Google 今天正式推出內部代號為「Nano Banana」(奈米屌?)的圖像生成模型 Gemini 2.5 Flash Image,標誌著其在圖像生成與編輯領域的強勢回歸。

Gemini 2.5 Flash Image 模型有4個主要特色,包括能讓同一人物或產品在不同場景中保持外觀一致的角色一致性;讓用戶以自然語言指令精準修改圖像,例如模糊背景、去除污漬,甚至是改變姿勢;多圖融合能力允許開發者可將多張圖像合成,輕鬆將物件放入新場景;還能整合世界知識,理解手繪圖表及教育應用,處理複雜的編輯需求。

新模型可透過 Gemini APIGoogle AI Studio 使用,定價為每百萬輸出 Token 收費 30 美元,由於每張圖像約需要 1,290 個 Token,平均每張圖像約 0.039 美元。

這使得 Gemini 2.5 Flash Image 成為那些將 AI 圖像能力整合到自身產品或服務中的企業的理想選擇,其低成本優勢能夠支撐大規模的商業應用,而不必擔心高昂的 API 費用。同時,所有生成與編輯的圖像都將附帶 SynthID 數位浮水印,確保了內容的透明度與可追溯性。

在市場策略上,Google 並未試圖與 MidjourneyDALL-E 3 等既有強敵直接在消費者社群層面競爭 。相反,該公司採取了以 API 為導向、深度整合的策略,將 Gemini 2.5 Flash Image 的能力嵌入主流專業應用程式,如 Adobe FireflyAdobe ExpressFigma 等 。

稍早在 Vertex AI Console 上面玩了一下,文生圖的速度挺快的,跟早期用 Stable Difussion 來生成圖片的速度相較之下,算是很快了(最慢10秒內都能生成圖片)。而它生成的圖片品質,跟早期使用 DALL·E 產生的圖片效果相比,已經明顯成熟許多。

但有時送出prompt後會無法生成圖片,且頻率不低。有時也會有部分背景沒有修改到的狀況,頻率也不低。總體來說,Gemini 2.5 Flash Image 的文生圖效果,還不到完美,但也算堪用了。

要產生模型公仔的照片,可以使用以下提示詞範例:

請用我提供的原圖,把圖片內主體變成電腦桌前的立體公仔。 場景為一張電腦書桌,上面擺放著一個 1/7 比例的 PVC 公仔,角色以站立姿態呈現,並固定在透明圓形底座上,呈現出細緻逼真的動漫風格收藏品質感。 在公仔的背後是一台電腦螢幕,螢幕上顯示該角色的 3D 設計圖,就像有人正在進行設計過程。 桌面上另外放置了鍵盤、滑鼠、咖啡杯,以及其模型盒,設計為市售收藏品風格,正面印有該角色的彩色動漫插圖,呈現完整的周邊商品氛圍。 整體場景需營造出真實的書桌環境,具有自然光線與景深效果,就像用相機拍攝的實景照片。

下面是使用 Gemini 2.5 Flash Image 生成圖片的效果


然後再用 Veo3 或是 Grok AI 的影片生成功能,就能生成一段動畫













熱門文章

2019, July 7~8【中國山東】老司機帶你攀登72位古代帝王曾登臨朝拜,以五嶽獨尊名揚天下的泰山(歷史典故+遊覽路線+遊記+照片)

台中【馨苑小料理】西區店|巷弄裡的人氣台菜店|米其林必比登推薦美食|提供合菜、個人套餐

【美國加州】此生必去超美風景!加州一號公路自駕遊~Half Moon Bay、17 Mile Drive、Bixby Greek Bridge、Big Sur、McWay Falls、Elephant Seal Rookery

Aug 2026【新北三峽】鳶尾山、鳶山、鳶山彩壁、五十分山環狀健行(環台北天際線第九段)

Mar 2026【隨筆】Clone a Meta Ray-ban Display glasses application|藍芽 L2CAP CoC 極致低延遲架構優化:實現 720p 智慧眼鏡流暢串流 👓(LIVE DEMO)

日本の登山の歷史

【南投信義】丹大林道與消失的省道台16線|可徒步深入中央山脈的經典長程林道

[平成27年1月18日]厳冬期雪山~滋賀県の最高峰・伊吹山に挑む!冬季限定直登ルート

Dec 2024【苗栗泰安】水雲餐廳溫泉民宿♨️🥢⛰️|水雲三星之橫龍山~騰龍山健行|台中西嶼龍新鮮海鮮古早味餐廳

Jul 2026【新北林口】觀音山小北插路線上鷹仔尖、東明山、潮音洞&一個關於被噁心的故事

文章列表

Contact

名稱

以電子郵件傳送 *

訊息 *