Full-Duplex Speech Systems
关注全双工语音交互,希望模型能像人类交流一样,在听与说的同时实现自然的打断与连续对答。

PERSONAL INFORMATION // 0017
也使用网名 prometheus0017
目前主要研究语音对话模型,同时也对各种有趣的新技术充满好奇,略有涉猎
继续向下刚开始接触这个领域,许多想法还在探索和构建中,以下是我目前比较感兴趣的方向
关注全双工语音交互,希望模型能像人类交流一样,在听与说的同时实现自然的打断与连续对答。
希望模型不仅能听懂话语里的语义,也能感知那些未说出口的情绪。在长久的陪伴与交流中,给予真诚的理解与共鸣。
对音频与音乐生成充满兴趣,关注生成模型如何捕捉旋律与氛围,为多媒体创作带来更多可能。

总有些奇奇怪怪的新世界,偶尔用好奇将我捕获
—— 那些闲暇时踏入的冒险领域(*'▽'*)
如果有任何想法
Feel free to reach out. (。・ω・。)ノ
这里记录了我活跃在网络上的各个节点。如果想了解更多,欢迎通过以下平台找到我: