AI@NEWS

Realtime-Venus发布9B实时全模态模型

该系统持续处理音视频流,自主决定响应时机,并在统一因果时间线上生成文本与语音。

推荐理由:其差异点不是简单增加视觉输入,而是以统一流式骨干处理观察、响应时机和语音生成,并支持语义打断与免训练长视频记忆,推进实时主动交互。

阅读原文