
帶鏡頭的 AI 耳機真的能取代 iPhone 嗎?
本文探討了配備鏡頭的 AI 耳機作為智慧型手機替代品的實際可行性。作者透過 72 小時的佩戴體驗,評估了這類穿戴式 AI 裝置目前的局限性與潛力。
Tag: #multimodal329 results

本文探討了配備鏡頭的 AI 耳機作為智慧型手機替代品的實際可行性。作者透過 72 小時的佩戴體驗,評估了這類穿戴式 AI 裝置目前的局限性與潛力。

愛範兒預告 GPT-5 終於能以自然人話說話。內容顯示「請稍等片刻」訊息。並推廣訂閱其微信公眾號以獲更多更新。

GPT-Image-2 最火玩法是看手相,AI 從手部影像給出過度奉承的運勢預測。用戶被正面回饋逗樂,突顯多模態 AI 的創意應用。這展示 AI 在娛樂領域的潛力。

詩歌相機是一款外觀迷人、復古風格的小工具,看似玩樂相機,實際上從拍攝場景生成 AI 詩歌並打印在熱敏收據紙上,而非照片。其白底櫻桃紅配色與編織肩帶極具吸引力。然而,測試後評測者對詩歌品質感到沮喪而非啟發。

TechRadar 作家使用 ChatGPT 將孩子的粗糙動物塗鴉轉換成驚人逼真的寫實生物。AI 保留了原始繪畫的本質,沒有大幅改變。這突顯了 ChatGPT 的多模態圖像生成能力。

一款自製 AI 老婆 App 用於教授任意語言,採用 Gemma-4-E4B-it 作為 LLM、經 FastAPI 的 OmniVoice TTS,以及 Vroid Studio 3D 模型。支援圖片上傳、網路搜尋,以及類似 Grok Ani 的語音/視訊通話。製作者讚賞 Gemma 4 無需解除審查即可良好遵循提示。

評測者戴Meta智慧眼鏡一個月,其內建AI助理由Judi Dench配音,提供導航、天氣更新及場景描述。內容創作者喜愛內建相機,但批評者稱其為「變態眼鏡」。此體驗引發對更多AI穿戴裝置必要性的質疑。
賽力斯汽車公布基於情緒識別的智能座艙控制專利。透過影片提取生理與面部特徵,實現非接觸式情緒偵測。此方法降低環境干擾並提升準確率。

Alibaba launches Qwen3.5-Plus, dominating open-source benchmarks in multimodal understanding, reasoning, coding, and agents, rivaling closed models like GPT-5.2. Priced at 0.8 RMB per million tokens, it's 18x cheaper than Gemini 3 Pro. Efficient design uses 39.7B parameters (17B active) for superior performance.

Alibaba's Qwen3.5-Plus launches as top open-source model in multimodal, reasoning, coding, and agents. Priced at 0.8 yuan per million tokens, it's 18x cheaper than Gemini 3 Pro. Achieves superior performance with efficient architecture.