“Hi” from AI Research Report
Hey!
在這個技術蓬勃發展和人工智能興起的時代,我們與所有人一樣,每天不停歇地研究和學習新事物,從中找到可以立即用在手邊任務,或是在下一個計畫派上用場的技術。有一天,一個點子湧入討論中:“要不要定期與所有同事們分享、討論與研究,像是來一份有關人工智慧技術的社內電子報試試?” 因此,有了這第一期電子報,啟動此項實驗計劃。
計畫剛剛起步,怎樣的內容對大家有益?怎樣才不會被當作垃圾信或是釣魚信?能有多少正規電子報的功能 (像是取消訂閱)?…等,還在邊試邊調整。期待得到你的支持和回饋,一起讓它成為對你我有益處的電子報。

Photo by cottonbro studio from Pexels
環球音樂對(生成式)音樂技術的表態
「如果是 AI 創作的藝術,它的版權屬於誰?」這個問題最近被問了太多次了。
不單單來自 Midjourney 給影像創作者與團體帶來這方面的議題, 音樂產業也開始關切了。那到底生成式音樂的版權怎麼歸屬?環球音樂集團 (Universal Music Group, as UMG) 可能有一個答案。
UMG 正在督促 (要求) 串流影音服務,禁止他們使用 AI 使用受版權保護的素材。因為,他們擔心 AI 生成的音樂聽起來太像流行歌手。
舉例來說,還停留在實驗室火力展示的 OpenAI Jukebox 與 Google MusicLM ,都展示了 txt2song 的可能性與一些範例結果。MusicLM 的論文指出,它使用了 280,000 小時的“原曲“來做訓練。
News about AI Research & Technology
- ChatGPT x Spotify:可不可以請 ChatGPT 整合我們家的曲庫,透過聊天的方式請它隨時針對用戶的需求,編出個歌單出來?來自德國慕尼黑工業大學的 İdil Sülo 在 github 放出了一個 repo,簡要試驗了串接 Spotify API + OpenAI API,讓它根據你輸入的 prompt 產生歌單…原文 。
- Faster H.266 codecs:AV1 codec 的最大競爭技術 H.266,它的開源專案 VVenC & VVdeC 在二月時的發佈指出,它又更快了一些了。它完整支援 Main10 profile,可以整合進 VLC 與 EXO Player,而且它跑在 Apple silicon 上的速度還不錯…原文 。
- RecSys for FAST:在影音串流服務中專做 B2B 推薦系統的技術公司 ThinkAnalytics 最近再次提出「You are What you Watch」,特別針對 FAST (免費廣告串流電視服務, or Free Ad-Supported Streaming Television) 提出了解決方案…原文 。
- Goodbye Prompt Engineering, Hello Prompt Generation:如果你有在玩 Midjourney, Stable Diffusion, ChatGPT 或是類似的服務,一定知道「好的 prompts 帶你上天堂,不好的 prompts…」。多倫多大學以及滑鐵盧大學在去年底共同合作了一篇論文 – Automatic Prompt Engineer (APE),目的在幫你產生更優質的 prompts,讓 prompt engineering 更有效率…原文 。
- Speech2Face:當我們聽到某人的聲音時,是否曾想過他們長什麼樣子?在 IEEE CVPR 2019上,有一篇名為 “Speech2Face: Learning the Face Behind a Voice” 引人入勝的研究論文。這篇開創性的研究論文使用深度神經網絡,僅通過聲音預測一個人的面孔…原文 。

Speech2Face: Learning the Face Behind a Voice
- 用 ChatGPT 進行一場文字冒險:一個新的應用程式讓冒險遊戲迷們與語言模型人工智慧 ChatGPT 一起玩個性化的遊戲。通過結合 ChatGPT 和 Midjourney 而創造出來的冒險遊戲,可以更加沉浸式 (台大電機李宏毅教授的實驗 )。開發人員 Yayapipi Goh 甚至創建了一個名為 “ChatGPT Adventure ” 的 RPG 文本冒險遊戲,任何人都可以體驗。
