它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。
Claude Opus、Sonnet模型现已支持语音模式:让对话“更有深度”
小米解读YU7 GT汽车命名:源于意大利语Gran Turismo,是一台适合长途旅行的跑车级SUV
没网也能“张口就翻”,安卓版谷歌翻译App正酝酿离线实时翻译
Youtube全面开放AI自动配音功能,支持中文等27种语言
通义千问Qwen3-TTS迎来升级:支持多音色、多语种和多方言
腾讯混元OCR模型宣布开源:参数仅1B,多项核心能力SOTA
06/25 00:17
06/25 00:16
06/25 00:15