多模态模型

共收录 8 个相关网站

2 个分类
20 个关联标签
8 个结果
智
智谱开放平台open.bigmodel.cn
智
智谱开放平台open.bigmodel.cn
智

智谱开放平台

open.bigmodel.cn

智谱开放平台是智谱AI推出的国产自主大模型开放服务阵地,面向个人开发者、中小创业团队与大型企业,提供GLM系列大语言模型、多模态视觉模型等资源,支持API快速调用与本地部署,可帮助开发主体降低AI研发成本,已累计服务超十万开发主体。

免费
J
Janus-Progithub.com
J
Janus-Progithub.com
J

Janus-Pro

github.com

Janus-Pro是深度求索DeepSeek推出的创新多模态大语言模型,支持同时完成多模态理解与文本生成图像任务,通过优化训练策略、扩展数据集与模型规模,有效提升了多模态任务处理表现,项目代码开源托管于GitHub平台,供开发者测试使用与二次开发。

免费
M
MiniMindgithub.com
M
MiniMindgithub.com
M

MiniMind

github.com

面向大模型学习爱好者的轻量开源大语言模型训练项目,以极低成本和极短时间就能完成完整大模型训练,提供从预训练到RLHF全流程PyTorch原生代码,覆盖单模态与多模态版本,大幅降低大模型学习门槛。功能覆盖核心使用场景,团队持续更新迭代,长期稳定可用。

免费
O
OmniHumanomnihuman-lab.github.io
O
OmniHumanomnihuman-lab.github.io
O

OmniHuman

omnihuman-lab.github.io

字节跳动研发的多模态条件驱动人体视频生成框架,可同时接受文本、图像、音频、姿态等多种输入条件,支持从单张静态照片生成完整全身动态数字人视频,为AI数字内容创作、数字人研发提供专业技术支撑,降低人体视频生成技术门槛。

免费
P
PonyFlashponyflash.com
P
PonyFlashponyflash.com
P

PonyFlash

ponyflash.com

面向AI Agent开发者的统一创意模型接入网关,支持语音、图像、视频等多类主流生成模型快速接入。开发者只需配置一个SKILL,即可为自主开发的AI Agent快速集成完整的多模态创意生成工具箱,降低模型接入开发成本。

免费
H
HunyuanVideo-Foleygithub.com
H
HunyuanVideo-Foleygithub.com
H

HunyuanVideo-Foley

github.com

腾讯开源的多模态视频拟音生成AI模型,依托腾讯混元多模态技术底座研发,可基于视频内容自动匹配生成符合画面逻辑的拟声音效,支持短视频创作、影视后期剪辑、自媒体内容制作等多场景应用,输出48kHz专业采样率音效,免费开源可供开发者二次定制开发。

免费
腾
腾讯混元大模型cloud.tencent.com
腾
腾讯混元大模型cloud.tencent.com
腾

腾讯混元大模型

cloud.tencent.com

腾讯官方自研的新一代通用大语言模型,依托腾讯云技术基础设施构建,面向开发者与企业用户提供自然语言理解、内容生成、多模态处理等能力,可支持各类AI应用场景开发与业务落地,助力企业降低AI研发门槛,提升数字化生产效率,服务国内人工智能产业生态发展。

免费
浦
浦语·灵笔2.5github.com
浦
浦语·灵笔2.5github.com
浦

浦语·灵笔2.5

github.com

浦语·灵笔2.5是上海人工智能实验室推出的开源多模态大模型,部署托管于GitHub平台,支持图文理解创作、语音识别解析、视频内容处理等多类能力,可面向开发者与内容创作者提供灵活的二次开发基础,也能直接用于搭建各类智能交互场景,适配不同行业的多模态应用开发需求。

免费