• 问

    投资者提问 2025-02-05 17:32:00

    来源:e互动

    看到新闻格灵深瞳公司基于Unicom的深瞳灵感-7B多模态大模型在业界同等规模的VLM模型中居世界领先地位,已经优于业界普遍使用的OpenAICLIP和谷歌SigLIP。请问该情况是否属实?公司目前自研开发的多模态大模型进展如何?是否已经开始进行公开开放落地使用?谢谢

    答格灵深瞳:2025-02-21 11:30:34

    尊敬的投资人,您好!公司自研的视觉大模型Unicom采用VisionTransformer的网络架构在10亿量级图像数据上预训练,学术评测超过CLIP和SigLIP,实验结果已经公布在计算机视觉会议ECCV2024相关论文上,模型已经开源github.com/deepglint/unicom。结合公司自研的视觉大模型Unicom和开源大语言模型,深瞳灵感-7B多模态大模型在具身问答(EmbodiedQuestionAnswering)任务和引用表达分割(ReferringExpressionSegmentation)任务中,与业界同等规模的VLM模型相比居世界领先地位。公司目前主要服务政企客户,正在推动持续研发的多模态大模型逐步落地应用,如需测试可通过上述开源链接下载及部署。感谢您的关注!

    标签

    多模态大模型研发
    模型开源
    落地应用推进
    多模态大模型

    属性

    乐观
    内容详尽
免责声明:本信息由证券之星从公开信息中摘录,不构成任何投资建议;证券之星不保证数据的准确性,内容仅供参考。

标签词云

  • 全部
  • 热点题材
  • 业务运营
  • 公司治理
  • 风险提示
  • 财务能力
欢迎访问证券之星!请点此与我们联系 版权所有: Copyright © 1996-年
返回顶部