字節跳動進軍世界模型 最快10月亮相
已沉寂展開完整內容
(綜合中時電子報、聯合報報導)
TikTok母公司字節跳動(ByteDance)傳出正開發一款可即時生成空間影片的人工智慧模型,進軍「世界模型」領域,最快可能於10月推出,與Meta及谷歌(Google)母公司Alphabet展開競爭。
根據彭博報導,字節跳動創辦人張一鳴親自督導新模型的開發,協調公司內部多個業務部門,並為項目調配AI人才與算力資源,顯示空間智慧已被列為公司重要技術方向[1]。不過,正式發布日期尚未敲定,相關時程仍可能調整。
新模型以字節跳動現有的電影級影片生成模型Seedance為基礎,可讓用戶為直播、短劇和遊戲創建可互動的虛擬世界。與谷歌的Genie類似,它將讓用戶置身於3D環境中並與之互動。該模型目的在生成能夠回應字節跳動旗下擴展現實業務Pico頭顯使用者語音或動作的虛擬世界。一名知情人士透露,該模型可按需生成每秒20幀的影片,延遲約為0.05秒,並為空間計算提供環境和交互介面[1]。
透過將生成空間內容所需的大量計算轉移至雲端,新模型有望降低頭顯對本地處理能力的要求,讓成本更低、配置更簡單的設備也能運行,從而降低用戶使用虛擬實境(VR)技術的門檻。快速生成內容的能力,也可能使爭奪用戶的競爭焦點從硬體規格轉向AI模型、計算基礎設施和內容分發平臺[1]。
張一鳴希望憑藉字節跳動在影片領域的技術實力,推動公司進入世界模型領域。這一路線被認為對機器人、遊戲和自動駕駛汽車的發展至關重要。知情人士提到,張一鳴也希望借助新模型,將字節跳動的AI模型、雲計算資源、內容平台,以及Pico的硬體串聯起來,形成相互帶動的「飛輪」效應[1]。
如果成功,新模型也可能為字節跳動與Meta及蘋果的競爭開闢新戰線。Meta及蘋果已在虛擬實境和混合現實設備上投入鉅資。Meta試圖圍繞Quest頭顯打造大眾市場生態系統,蘋果則將Vision Pro定位為高階空間計算平台,但兩者都尚未實現廣泛普及[1]。
本事件已沉寂,相關脈絡見「相關事件」