多模态大模型共3篇
SeedRealtime:字节跳动原生音视频全双工大模型,让 AI「边看边听边说」-圈圈AI一站式AI资源分享平台

SeedRealtime:字节跳动原生音视频全双工大模型,让 AI「边看边听边说」

官方背景 SeedRealtime 是字节跳动 Seed 团队于 2026 年 8 月 5 日推出的原生音视频全双工大模型,也是走向全模态交互的关键一步。它用统一端到端架构原生融合音频、视频与文本,已在豆包 App ...
圈圈的头像-圈圈AI一站式AI资源分享平台钻石会员圈圈8月9日 09:44
028164
Amazon Nova:AWS Bedrock 的全模态基础模型家族,理解生成语音视频一网打尽-圈圈AI一站式AI资源分享平台

Amazon Nova:AWS Bedrock 的全模态基础模型家族,理解生成语音视频一网打尽

官方背景 Amazon Nova 是 AWS 在 2024 年 12 月随 re:Invent 推出、跑在 Bedrock 上的全模态基础模型家族,定位为理解、生成、交互一体化的产业级底座。它覆盖从轻量到旗舰的理解模型,以及图像...
圈圈的头像-圈圈AI一站式AI资源分享平台钻石会员圈圈8月3日 09:26
0323102
Gemini-圈圈AI一站式AI资源分享平台

Gemini

Gemini 是 Google DeepMind 研发的多模态 AI 助手,2023 年以 Bard 之名首次亮相,2024 年 2 月正式更名 Gemini。名称源自 Google Brain 与 DeepMind 两大研究团队的合并,象征着谷歌 AI 战略的...
圈圈的头像-圈圈AI一站式AI资源分享平台钻石会员圈圈7月23日 11:27
023798