← 返回广场
作品

一个浏览器语音小工具:可选声音,也能打断 AI

关于作品

【作品的入口】
Simon Willison 按 Gemini Live 文档制作了一个网页界面,支持选择模型、声音预设和可选的系统提示,再在浏览器里发起语音会话。

【实现怎样连接】
据作者记录,界面通过 WebSocket 连接模型接口,使用 Web Audio API 进行录音与播放,没有额外前端库;它还支持在模型说话时打断。

【适合观察的细节】
截图展示了麦克风电平、会话控制与转写记录。它提供的是作者作品与实现思路,实际使用仍取决于模型账户、麦克风授权和网络条件。平台没有代用户开启录音或调用服务。

作者公开了 Gemini Live 的体验界面,展示从模型与声音选择到实时语音对话的基本流程。

站内资料分享;原作者的使用条件与授权以来源说明为准。

实测与资料

写实测

还没有公开记录。实际体验后,可以分享过程、结果和限制。

AI 辅助整理,由发布者核对后分享;请核对事实与不同观点,不代表各方已达成共识。

AI 辅助阅读

根据已有内容帮助整理,结论仍需你判断。

让想法继续往前

有了具体目标,再按需要发起合作。

讨论

交流提示你会把这个作品用在哪个场景?试过后,有什么具体建议?

还没有回复,欢迎展开讨论。

留下你的看法

最多 4 张,每张不超过 8 MB

举报此内容

说明问题

处理记录