说话人识别和更快的语言模型现已可用
· 2 分钟阅读时间

借助改进的转录功能和 Gemini 3.5 Flash,更高效地工作。
日期: 2026-06-09
类别: 新闻
AI-Public 现已提供新的模型,帮助您在公共部门内部更高效、更准确地工作。最重要的新增功能是转录模块的新模型:gpt-4o-transcribe-diarize。
该模型可自动识别何时轮到另一位说话人发言。这使得整理访谈、参与式会议或与同事的讨论变得更加清晰。文本会直接按发言人分开(例如说话人 A 和说话人 B),从而大幅减少您手动编辑对话记录所需的时间。带有说话人识别的改进转录功能,会在您为音频录音启动转录模块时自动应用。
此外,我们还将 Gemini 3.5 Flash 加入了语言模型阵容。该模型专为速度和效率而设计,非常适合需要立即得到结果的任务,例如为公众沟通生成简短文本建议、快速总结收到的来信,或在工作中回答事实性问题。
通过这些更新,您可以将更多时间投入到工作的内容本身,而由 AI-Public 更快、更清晰地为您完成支持性任务。
这些新模型现已向组织内所有用户开放,可立即使用。