2024中国国际大数据产业博览会(简称“数博会”)将于8月28日开幕,亚太地区知名的智能语音和人工智能上市企业——科大讯飞股份有限公司(简称“科大讯飞”)第六年应邀参展,将携其明星产品——“讯飞星火大模型”登场亮相。
讯飞星火大模型是由科大讯飞推出的新一代认知智能大模型,拥有跨领域的知识和语言理解能力,能够基于自然对话方式理解与执行任务,提供语言理解、知识问答、逻辑推理、数学题解答、代码理解与编写等服务,能够与科大讯飞的技术生态体系无缝集成,实现与科大讯飞的其他产品和服务相互配合,为用户提供更为流畅和全面的智能体验。
该大模型目前已拥有多个重点行业头部企业合作伙伴,包括国家能源集团、中国石油、中国移动、中国人保、中国一汽、大众汽车、海尔集团、美的集团等。在国务院发展研究中心、新华社研究院、《麻省理工科技商业评论》等权威机构的评测中,讯飞星火的综合能力在国内排名第一。在国内外中英文12项主流测试中,讯飞星火V4.0实现8项超越,支持74个语种方言免切换功能,破解强干扰场景下的语音识别难题,发布极复杂场景语音转写技术,并通过云边端及软硬一体化解决方案,赋能汽车、家电、机器人等领域人机交互变革。
2024年1月30日,星火开源-13B正式在华为昇思开源社区联合首发上线,这是业界首个基于全国产算力平台“飞星一号”研发的开源大模型。截至2024年7月31日,讯飞星火APP在安卓端累计下载达1.6亿次,用户通过讯飞星火开发出约11.9万个AI助手。
本次展会,科大讯飞通过线上线下相结合的展示方式,将全面展现其在智能语音、计算机视觉、自然语言处理、认知智能等核心技术领域的卓越研发实力与产业化成果,以及在AI+教育、AI+医疗、AI+司法、AI+城市、AI+办公等领域的典型应用案例,为与会观众、产业嘉宾和参展企业带来一场全新体验。
好文章,需要你的鼓励
韩国科学技术院研究团队提出"分叉-合并解码"方法,无需额外训练即可改善音视频大语言模型的多模态理解能力。通过先独立处理音频和视频(分叉阶段),再融合结果(合并阶段),该方法有效缓解了模型过度依赖单一模态的问题,在AVQA、MUSIC-AVQA和AVHBench三个基准测试中均取得显著性能提升,特别是在需要平衡音视频理解的任务上表现突出。
这项研究利用大语言模型解决科学新颖性检测难题,南洋理工大学团队创新性地构建了闭合领域数据集并提出知识蒸馏框架,训练轻量级检索器捕捉想法层面相似性而非表面文本相似性。实验表明,该方法在市场营销和NLP领域显著优于现有技术,为加速科学创新提供了有力工具。
un?CLIP是一项创新研究,通过巧妙反转unCLIP生成模型来增强CLIP的视觉细节捕捉能力。中国科学院研究团队发现,虽然CLIP在全局图像理解方面表现出色,但在捕捉细节时存在不足。他们的方法利用unCLIP生成模型的视觉细节表示能力,同时保持与CLIP原始文本编码器的语义对齐。实验结果表明,un?CLIP在MMVP-VLM基准、开放词汇语义分割和视觉中心的多模态任务上显著优于原始CLIP和现有改进方法,为视觉-语言模型的发展提供了新思路。
这项研究介绍了RPEval,一个专为评估大语言模型角色扮演能力而设计的新基准。研究团队从法国里尔大学开发的这一工具专注于四个关键维度:情感理解、决策制定、道德对齐和角色一致性,通过单轮交互实现全自动评估。研究结果显示Gemini-1.5-Pro在总体表现上领先,而GPT-4o虽在决策方面表现出色,但在角色一致性上存在明显不足。这一基准为研究人员提供了一个可靠、可重复的方法来评估和改进大语言模型的角色扮演能力。