首页 > 教程攻略 > ai资讯 >智谱AI发布了类GPT4o的视频通话功能,现在可以和AI无缝交流了

智谱AI发布了类GPT4o的视频通话功能,现在可以和AI无缝交流了

来源:互联网 时间:2026-08-25 14:34:46

在KDD大会上,智谱AI一口气更新了多款大模型,从语言基座到文生图、图像/视频理解,再到视频生成,覆盖了当前最热的几个方向。下面就来逐一看看这些新模型带来了哪些实质性提升。

GLM-4-Plus 语言基座模型

作为智谱的核心语言模型,GLM-4-Plus在语言解析、指令执行和长篇幅文本处理上实现了显著飞跃。从目前释放的信息来看,它在全球AI领域的地位已经相当靠前。具体能力包括:视频总结、深度推理、多轮对话,以及时间问答——这些功能组合起来,意味着模型在理解复杂语义和跨模态信息方面又上了一个台阶。

CogView-3-Plus 文生图模型

文生图领域竞争激烈,而CogView-3-Plus宣称其性能与业界顶尖的MJ-V6和FLUX模型旗鼓相当。从展示的样图来看,细节和风格把控确实令人印象深刻。目前该模型已集成到智谱清言中,用户可以直接在清言APP内体验。此外,API也已开放,开发者可通过智谱AI开放平台BigModel接入使用。

GLM-4V-Plus 图像/视频理解模型

视觉理解模型GLM-4V-Plus不仅图像识别能力出色,还引入了先进的时间感知机制,能够优化视频内容的理解。值得注意的是,这将是国内首次推出通用视频理解模型的API,标志着落地应用迈出了关键一步。其综合性能指标已接近GPT-4o的水平。

CogVideoX 视频生成模型

视频生成一直是热门赛道,智谱的CogVideoX继2B版本开源后,此次又正式开源了5B版本。性能大幅提升,可以说在开源视频生成领域暂时处于领跑位置。官方还展示了一段花园中蝴蝶飞舞的生成示例,画面动态与光影质感令人舒适:
"A garden comes to life as a kaleidoscope of butterflies flutters amidst the blossoms, their delicate wings casting shadows on the petals below..."
<iframe allowfullscreen="" frameborder="0" src="https://mp.weixin.qq.com/mp/readtemplate?t=pages/video_player_tmpl&action=mpvideo&auto=0&vid=wxv_3613044344774737925"></iframe>

另外,智谱清言的视频通话功能目前还在内测阶段,从透露的信息看,未来人机交互的方式可能更加自然直接。