作品
一个浏览器语音小工具:可选声音,也能打断 AI

关于作品
【作品的入口】
Simon Willison 按 Gemini Live 文档制作了一个网页界面,支持选择模型、声音预设和可选的系统提示,再在浏览器里发起语音会话。
【实现怎样连接】
据作者记录,界面通过 WebSocket 连接模型接口,使用 Web Audio API 进行录音与播放,没有额外前端库;它还支持在模型说话时打断。
【适合观察的细节】
截图展示了麦克风电平、会话控制与转写记录。它提供的是作者作品与实现思路,实际使用仍取决于模型账户、麦克风授权和网络条件。平台没有代用户开启录音或调用服务。
Simon Willison 按 Gemini Live 文档制作了一个网页界面,支持选择模型、声音预设和可选的系统提示,再在浏览器里发起语音会话。
【实现怎样连接】
据作者记录,界面通过 WebSocket 连接模型接口,使用 Web Audio API 进行录音与播放,没有额外前端库;它还支持在模型说话时打断。
【适合观察的细节】
截图展示了麦克风电平、会话控制与转写记录。它提供的是作者作品与实现思路,实际使用仍取决于模型账户、麦克风授权和网络条件。平台没有代用户开启录音或调用服务。
作者公开了 Gemini Live 的体验界面,展示从模型与声音选择到实时语音对话的基本流程。
站内资料分享;原作者的使用条件与授权以来源说明为准。
实测与资料
写实测还没有公开记录。实际体验后,可以分享过程、结果和限制。
AI 辅助整理,由发布者核对后分享;请核对事实与不同观点,不代表各方已达成共识。
让想法继续往前
有了具体目标,再按需要发起合作。
讨论
交流提示你会把这个作品用在哪个场景?试过后,有什么具体建议?
还没有回复,欢迎展开讨论。