共收录 8 个相关网站
open.bigmodel.cn
智谱开放平台是智谱AI推出的国产自主大模型开放服务阵地,面向个人开发者、中小创业团队与大型企业,提供GLM系列大语言模型、多模态视觉模型等资源,支持API快速调用与本地部署,可帮助开发主体降低AI研发成本,已累计服务超十万开发主体。
github.com
Janus-Pro是深度求索DeepSeek推出的创新多模态大语言模型,支持同时完成多模态理解与文本生成图像任务,通过优化训练策略、扩展数据集与模型规模,有效提升了多模态任务处理表现,项目代码开源托管于GitHub平台,供开发者测试使用与二次开发。
面向大模型学习爱好者的轻量开源大语言模型训练项目,以极低成本和极短时间就能完成完整大模型训练,提供从预训练到RLHF全流程PyTorch原生代码,覆盖单模态与多模态版本,大幅降低大模型学习门槛。功能覆盖核心使用场景,团队持续更新迭代,长期稳定可用。
omnihuman-lab.github.io
字节跳动研发的多模态条件驱动人体视频生成框架,可同时接受文本、图像、音频、姿态等多种输入条件,支持从单张静态照片生成完整全身动态数字人视频,为AI数字内容创作、数字人研发提供专业技术支撑,降低人体视频生成技术门槛。
ponyflash.com
面向AI Agent开发者的统一创意模型接入网关,支持语音、图像、视频等多类主流生成模型快速接入。开发者只需配置一个SKILL,即可为自主开发的AI Agent快速集成完整的多模态创意生成工具箱,降低模型接入开发成本。
腾讯开源的多模态视频拟音生成AI模型,依托腾讯混元多模态技术底座研发,可基于视频内容自动匹配生成符合画面逻辑的拟声音效,支持短视频创作、影视后期剪辑、自媒体内容制作等多场景应用,输出48kHz专业采样率音效,免费开源可供开发者二次定制开发。
cloud.tencent.com
腾讯官方自研的新一代通用大语言模型,依托腾讯云技术基础设施构建,面向开发者与企业用户提供自然语言理解、内容生成、多模态处理等能力,可支持各类AI应用场景开发与业务落地,助力企业降低AI研发门槛,提升数字化生产效率,服务国内人工智能产业生态发展。
浦语·灵笔2.5是上海人工智能实验室推出的开源多模态大模型,部署托管于GitHub平台,支持图文理解创作、语音识别解析、视频内容处理等多类能力,可面向开发者与内容创作者提供灵活的二次开发基础,也能直接用于搭建各类智能交互场景,适配不同行业的多模态应用开发需求。