阿里通官方网站
-
发布了文章 2个月前
阿里通义视频生成大模型即将上线,预约通道已开启
阿里巴巴旗下的通义实验室即将推出重磅新品——视频生成大模型!这个消息对于广大AI爱好者和内容创作者来说无疑是个好消息。目前,通义App频道和通义万相PC端已经上线了“视频生成”的预约入口,这意味着大家很快就能体验...
-
发布了文章 2个月前
阿里通义上新PPT创作!PC端“效率”功能三合一,听读写一站搞定
阿里通义上新PPT创作!PC端“效率”功能三合一,听读写一站搞定 这年头,哪有人上班不发疯的(doge)。...
-
发布了文章 2个月前
ZeroSearch – 阿里通义开源的大模型搜索引擎框架
ZeroSearch 是阿里巴巴通义实验室开源的创新大模型搜索引擎框架,基于强化学习激励大模型的搜索能力,无需与真实搜索引擎交互。框架爱基于大模型预训练知识,转化为检索模块,根据查询生成相关或噪声文档,动态控制生成质量。...
-
发布了文章 2个月前
OmniSearch – 阿里通义推出的多模态检索增强生成框架
OmniSearch是阿里巴巴通义实验室推出的多模态检索增强生成框架,具备自适应规划能力。OmniSearch能动态拆解复杂问题,根据检索结果和问题情境调整检索策略,模拟人类解决复杂问题的行为,提升检索效率和准确性。Omni...
-
发布了文章 2个月前
OmniAudio – 阿里通义推出的空间音频生成模型
OmniAudio 是阿里巴巴通义实验室语音团队推出的从360°视频生成空间音频(FOA)的技术。为虚拟现实和沉浸式娱乐提供更真实的音频体验。通过构建大规模数据集Sphere360,包含超过10.3万个视频片段,涵盖288种...
-
发布了文章 2个月前
MaskSearch – 阿里通义推出的检索增强预训练框架
MaskSearch是阿里巴巴通义实验室推出的新型通用预训练框架,提升大型语言模型(LLM)的智能体搜索能力。通过检索增强掩码预测(RAMP)任务,让模型在输入文本中对关键信息掩码。...
-
发布了文章 2个月前
HumanOmni – 阿里通义等推出专注人类中心场景的多模态大模型
HumanOmni 是专注于人类中心场景的多模态大模型,视觉和听觉模态融合而成。通过处理视频、音频或两者的结合输入,能全面理解人类行为、情感和交互。模型基于超过240万视频片段和1400万条指令进行预训练,采用动态权重调整机...
-
发布了文章 2个月前
AnyStory – 阿里通义推出的高保真个性化文本到图像生成框架
AnyStory是阿里巴巴通义实验室研发的创新文本到图像生成框架,实现单个和多个主体的高保真个性化图像生成。通过“编码-路由”的方法来建模主体个性化问题。在编码阶段,AnyStory结合强大的ReferenceNet和CLI...
-
发布了文章 2个月前
ACE++ – 阿里通义推出的升级版图像生成与编辑模型
ACE++是阿里巴巴通义实验室推出的先进的图像生成与编辑工具,通过指令化和上下文感知的内容填充技术,实现了高质量的图像创作和编辑功能。...
-
发布了文章 2个月前
Manus与阿里通义达成合作
据媒体报道,火爆异常的AI Agent新秀Manus和阿里云旗下大语言模型通义千问达成合作。双方将基于通义千问系列开源模型,在国产模型和算力平台上实现Manus的全部功能;双方将共同推动通用智能体技术的普惠化与商业化落地。...
没有更多内容























