验证码:

换一张

忘记密码？记住我

取消登录

切换中国科技网通行证登录

切换中国科技网通行证登录

取消

中文版 | English

中国科学院自动化研究所机构知识库

Knowledge Commons of Institute of Automation，CAS

登录注册

图片搜索

粘贴图片网址

首页
研究单元&专题
作者
文献类型
知识图谱
新闻&公告

在结果中检索

研究单元&专题

多模态人工智能系统... [20]

紫东太初大模型研究中... [1]

模式识别实验室 [1]

作者

文献类型

期刊论文 [20]

发表日期

2023 [20]

语种

出处

ACM Transa... [2]

IEEE TRANS... [2]

IEEE-ACM T... [2]

ACM Transa... [1]

BIOMEDICAL... [1]

IEEE Intel... [1]

资助项目

National N... [3]

National N... [2]

National N... [2]

National N... [2]

National N... [2]

111 Projec... [1]

收录类别

SCI [20]

导师

资助机构

National N... [5]

National K... [3]

Beijing Na... [2]

National N... [2]

111 Projec... [1]

Beijing Mu... [1]

知识图谱

CASIA OpenIR

已提交作品

待认领作品

已认领作品

未提交全文

浏览/检索结果: 共20条，第1-10条

帮助

限定条件	收录类别：SCI 发表日期：2023 专题：多模态人工智能系统全国重点实验室第一作者的第一单位第一作者单位通讯作者单位

已选(0)清除条数/页：排序方式：
	Modal Contrastive Learning Based End-to-End Text Image Machine Translation 期刊论文 IEEE/ACM Transactions on Audio, Speech, and Language Processing (IEEE/ACM TASLP), 2023, 卷号: 32, 期号: 32, 页码: 2153-2165 作者: Ma, Cong; Han, Xu; Wu, Linghui; Zhang, Yaping; Zhao, Yang; Zhou, Yu; Zong, Chengqing Adobe PDF(6551Kb) \| 收藏 \| 浏览/下载：40/19 \| 提交时间：2024/06/26 Transformers Machine translation Decoding Semantics Pipelines Text recognition Task analysis Text image machine translation contrastive learning text image recognition machine translation
	Efficient multimodal transformer with dual-level feature restoration for robust multimodal sentiment analysis 期刊论文 IEEE Transactions on Affective Computing, 2023, 卷号: 15, 期号: 1, 页码: 1-17 作者: Licai Sun; Zheng Lian; Bin Liu; Jianhua Tao Adobe PDF(2371Kb) \| 收藏 \| 浏览/下载：73/20 \| 提交时间：2024/05/31 Transformers Robustness Semantics Data models Computational modeling Videos Training Multimodal sentiment analysis unaligned and incomplete data efficient multimodal Transformer dual-level feature restoration robustness
	HetGRec: Heterogeneous Graph Attention Network for Group Recommendation 期刊论文 IEEE Intelligent Systems, 2023, 卷号: 38, 期号: 1, 页码: 9-18 作者: Song Zhang; Nan Zheng; Danli Wang Adobe PDF(2471Kb) \| 收藏 \| 浏览/下载：31/10 \| 提交时间：2024/05/31
	Learning to Reduce Scale Differences for Large-Scale Invariant Image Matching 期刊论文 IEEE Transactions on Circuits and Systems for Video Technology, 2023, 卷号: 33, 期号: 3, 页码: 1335 - 1348 作者: Fu Yujie; Zhang Pengju; Liu Bingxi; Rong Zheng; Wu Yihong Adobe PDF(4879Kb) \| 收藏 \| 浏览/下载：67/28 \| 提交时间：2024/05/28 Image Matching Large Scale Changes Scale Difference Reduction Scale Ratio Estimation Covisibility-attention-reinforced Matching Module
	Coarse Mask Guided Interactive Object Segmentation 期刊论文 IEEE TRANSACTIONS ON IMAGE PROCESSING, 2023, 卷号: 32, 页码: 5808-5822 作者: Li, Jing; Fan, Junsong; Wang, Yuxi; Yang, Yuran; Zhang, Zhaoxiang Adobe PDF(4323Kb) \| 收藏 \| 浏览/下载：77/7 \| 提交时间：2024/02/22 Segmentation Interactive Transformer Annotation Tool
	Towards Unified Multi-Domain Machine Translation With Mixture of Domain Experts 期刊论文 IEEE-ACM TRANSACTIONS ON AUDIO SPEECH AND LANGUAGE PROCESSING, 2023, 卷号: 31, 页码: 3488-3498 作者: Lu, Jinliang; Zhang, Jiajun Adobe PDF(2882Kb) \| 收藏 \| 浏览/下载：162/15 \| 提交时间：2023/12/21 Machine Translation Multi-domain Mixture-of-expert
	SignParser: An End-to-End Framework for Traffic Sign Understanding 期刊论文 INTERNATIONAL JOURNAL OF COMPUTER VISION, 2023, 卷号: 132, 期号: 2, 页码: 805-821 作者: Guo, Yunfei; Feng, Wei; Yin, Fei; Liu, Cheng-Lin Adobe PDF(7011Kb) \| 收藏 \| 浏览/下载：138/9 \| 提交时间：2023/12/21 Traffic sign understanding Content reasoning Semantic description generation
	Semantic Policy Network for Zero-Shot Object Goal Visual Navigation 期刊论文 IEEE ROBOTICS AND AUTOMATION LETTERS, 2023, 卷号: 8, 期号: 11, 页码: 7655-7662 作者: Zhao, Qianfan; Zhang, Lu; He, Bin; Liu, Zhiyong Adobe PDF(1888Kb) \| 收藏 \| 浏览/下载：155/20 \| 提交时间：2023/12/21 Deep learning path planning reinforcement learning vision-based navigation
	Reducing Vision-Answer Biases for Multiple-Choice VQA 期刊论文 IEEE TRANSACTIONS ON IMAGE PROCESSING, 2023, 卷号: 32, 页码: 4621-4634 作者: Zhang, Xi; Zhang, Feifei; Xu, Changsheng Adobe PDF(2684Kb) \| 收藏 \| 浏览/下载：99/9 \| 提交时间：2023/11/17 Multiple-choice VQA vision-answer bias causal intervention counterfactual interaction learning
	Adversarial Multi-Task Learning for Mandarin Prosodic Boundary Prediction With Multi-Modal Embeddings 期刊论文 IEEE-ACM TRANSACTIONS ON AUDIO SPEECH AND LANGUAGE PROCESSING, 2023, 卷号: 31, 页码: 2963-2973 作者: Yi, Jiangyan; Tao, Jianhua; Fu, Ruibo; Wang, Tao; Zhang, Chu Yuan; Wang, Chenglong 收藏 \| 浏览/下载：85/0 \| 提交时间：2023/11/17 Adversarial training multi-task learning prosodic boundaries speech synthesis multi-modal embeddings

首页
研究单元产出分布图
收录类型分布图
论文引用排行
作者
文献类型
学科分类
关于网站
使用帮助
联系我们

条目量25852
全文量13690
访问量5828715
下载量910006

版权所有 @2018 - 2024 中国科学院自动化研究所 - Powered by CSpace

地址邮编: 北京市海淀区中关村东路95号（100190）
电话: 010－82544495