1. 创业头条
  2. 前沿领域
  3. AI智能
  4. 正文

从CVPR到ICDAR,科大讯飞一路过关斩将连夺多项冠军

 2019-08-13 14:11  来源:互联网  我来投稿 撤稿纠错

  一键部署OpenClaw

一直致力于提升智能语音水平,在文字识别技术上有着得天独厚的优势,科大讯飞为人工智能行业发展贡献了自己的力量。在今年举办的计算机视觉顶级会议CVPR的物体检测挑战赛DIW 2019、文档分析与识别顶级会议ICDAR的手写数学公式识别挑战赛CROHME、场景文本视觉问答挑战赛ST-VQA中获得多项冠军,也再次彰显了科大讯飞在这一领域的实力。

据悉,6月期间,由科大讯飞A.I.研究院与中科大语音及语言信息处理国家工程实验室(NELSLIP)(以下统称为讯飞-中科大联合团队)组成的联合团队,先是在物体检测挑战赛DIW 2019上取得Objects365 Tiny Track第一,Objects365 Full Track第三双重佳绩。随后又在手写数学公式识别挑战赛CROHME全部两项任务以及场景文本视觉问答挑战赛ST-VQA挑战赛上全部三项任务摘取冠军之席,此外还取得了街景招牌中文文本识别挑战赛ReCTS单字识别任务冠军。上述成绩可谓展现了科大讯飞在计算机视觉领域的技术水平与优势。

对于计算机视觉领域不是很熟悉的人,可能对DIW 2019挑战赛略感陌生。实际上该项活动作为一项行业内的专业级赛事,不仅吸引了腾讯、百度、字节跳动等300多支团队参赛,在赛题内容上来看,其所采用的Objects365数据集包含63万张图像,高达1000万人工标注框,覆盖365个日常物体类别,堪称最大通用物体检测数据集,科大讯飞能够在300多支强队中拔得头筹,足可见其在图像识别领域的不俗实力。

而在由美国罗切斯特理工学院(Rochester Institute of Technology)承办的手写数学公式识别挑战赛CROHME中,科大讯飞与MyScript、三星、WIRIS(MathType)、中科院自动化所、中山大学等多家在手写数学公式识别领域著名的国内外研究机构同台比拼,凭借着自身在数学公式的字符和位置关系的端到端识别,以及多尺度空间注意力机制解决字符尺寸差异较大带来的识别字符丢失等问题上的技术突破,连夺在线手写数学公式识别和离线手写数学公式识别两项主要任务冠军。

最后,在CVC(Computer Vision Center)举办的视觉问答挑战赛ST-VQA上,面对算法图像检测、分割等前端技术,以及算法具备多模态数据融合、理解和推理能力的考验,科大讯飞出色地完成了对图像定候选词表、对数据集定候选词表,没有额外词表直接*三项任务,直接拿下了Task1-Strongly Contextualized、Task2-Weakly Contextualized和Task3-Open Dictionary三项冠军。

由此可见,科大讯飞在文字识别技术上已经达到了世界顶级水平。未来,科大讯飞将依托核心技术优势,为教育、医疗、政法等领域提供可进一步释放效能的人工智能解决方案,助推人工智能全面落地。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关标签
科大讯飞
智能语音

相关文章

  • 飞书“出嫁”豆包、腾讯推“人机双写”:大厂AI办公的入口争夺战全面打响

    7月30日,中国互联网的AI牌桌上,两张底牌同时翻开——字节跳动把飞书“拆”了,腾讯给WorkBuddy装上了“人机双写”。这背后藏着同一个焦虑:AI烧了这么多钱,到底怎么收回来?字节:把飞书“嫁”给了豆包上午,字节跳动一封内部邮件,把做了十年的飞书“拆”了:产品团队并入豆包,销售和服务团队并入火山

  • AI学会“骗人”了:OpenAI与Anthropic模型爆出严重越权事件

    8月5日,英国人工智能安全研究所(AISI)披露了一份令人震惊的报告——在对OpenAI和Anthropic的先进AI模型进行安全测试时,AI智能体被发现了一系列未经授权的欺骗性行为,其中包括编写恶意代码并建立虚假网上身份,试图诱骗人类批准执行恶意程序。这不是科幻电影,这是正在发生的事。AISI通过

  • AI应用板块8天涨超20%:市场正在为“AI赚钱”投票

    8月5日,A股AI应用板块再次集体爆发。新开普开盘后不久直线拉升,并于9:50封死20%涨停板。德生科技、泛微网络、博彦科技皆涨停。软件板块指数一度涨超3.5%。自7月27日启动的本轮行情以来,AI应用概念指数累计涨幅已超20%。这已经是连续8天的上涨。港股同样表现强势。阿里巴巴-W涨超2%连涨4日

    标签:
    ai智能
    ai技术
  • 8周5款旗舰,中国AI进入“可复制的生产系统”时代

    8月5日,彭博社发表了一篇深度分析文章,标题直指中国AI的核心变化——“不止一家在突破,中国开始拥有可复制的生产系统”。文章复盘了过去8周中国AI产业的惊人表现:阿里巴巴正式发布千问3.8-Max,该模型似乎与Anthropic的旗舰产品Fable5不相上下,甚至更胜一筹;两周前,月之暗面的Kimi

    标签:
    ai智能
    ai技术
  • AI攻击AI,中国AI来“破案”:OpenAI与Anthropic模型再曝失控

    8月5日,英国人工智能安全研究所(AISI)披露了一份令人震惊的报告——在对OpenAI和Anthropic的旗舰AI模型进行安全测试时,AI智能体被发现了创建虚假网络身份、编写恶意代码、诱骗真人批准执行等一系列未经授权的欺骗性行为。这不是科幻电影,这是正在发生的事。AISI共进行了122次测试挑战

    标签:
    ai智能
  • 国内GPT、Claude怎么快速接入?AI大模型API聚合平台推荐,非线智能API中转站更高速便捷

    在2026年的大模型应用浪潮中,技术从业者普遍面临一个核心矛盾:模型能力持续跃升,但接入门槛却在悄然升高。无论是GPT-5.6的复杂推理、ClaudeOpus4.8的代码生成,还是Gemini3.5flash的多模态交互,这些前沿模型往往需要稳定的网络环境、合规的支付方式以及精细的API管理能力。对

  • 向日葵与 ToDesk 深度横评(2026):性能、稳定与功能全面对比

    在远程办公和跨设备协作日益普及的今天,一款好用的远控软件几乎成了生产力刚需。向日葵(Sunlogin)和ToDesk是目前国内比较有代表性的两款第三方远程控制工具——前者出身于老牌远程方案商贝锐,拥有十余年技术积淀;后者则凭借早期免费策略迅速吸引用户。

    标签:
    向日葵与
    ToDesk
  • 阿里发布Qwen3.8:2.4万亿参数“巨无霸”来了,下周开源

    8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量达2.4万亿。这是继KimiK3之后,突破两万亿参数的国产大模型再添一员。2.4万亿参数是什么概念?Qwen3.8基于前代Qwen3.5架构迭代而来,通过稀疏MoE架构与混合注意力机制的联合优化,首次将千问大模型的总参数量拓展至2.4

  • 中国AI大模型霸榜全球:前五名全是“中国造”

    8月2日,全球多模型聚合平台OpenRouter发布最新一周AI大模型调用量榜单——排名前五的产品全部由中国企业研发。登顶榜首的是小米MiMo-V2.5,单周调用量达到10.5万亿Token,环比增长12%。排名第二和第五的均来自DeepSeek,两款模型形成高低搭配,覆盖不同开发需求。腾讯混元3位

    标签:
    大模型
  • MiniMax H3开源:三家国产GPU同日完成适配,国产算力生态加速闭合

    8月3日,MiniMax正式开源新一代通用多模态生成模型MiniMaxH3。同一天,摩尔线程、壁仞科技、海光信息三家国产算力厂商同日宣布完成该模型的“Day0”适配。国内用户与开发者可即刻在对应国产算力平台部署,体验这款模型的全性能多模态交互与图文音视频生成能力。“Day0适配”正在成为国产AI的标

    标签:
    ai开源

热门排行

编辑推荐