关于我。
简历 ↗我是 Robin,论文署名 Bin Wang,中文名王斌。我在新加坡的 Apodex 从事 AI 研究与工程,工作涵盖智能体框架、多智能体协作,以及预训练数据获取与质量评估。
我于 2021 年在 USC 获得博士学位,师从 C.-C. Jay Kuo 教授,此前在电子科技大学完成本科学习。在 NUS 和 A*STAR I²R,我研究对话摘要、多语言评测与音频语言模型。我的工作贯穿研究、架构设计与工程实现,已发表 60 余篇论文。
我在山东济宁长大,先后在成都、香港、奥沙瓦与洛杉矶求学,2021 年来到新加坡,2024 年成为永久居民。工作之外,我喜欢健身、读书、整理音频 AI 资源,也在这里记录职业选择和生活中的想法。
智能体系统与训练数据
从零搭建深度研究智能体框架,设计多源验证、并行工具调用与多智能体协作。近期关注大规模预训练数据获取,以及域名和 URL 层面的质量评估。
Apodex 1.1 · Apodex-1.0 · FrontierAgent · Apodex 1.1 · mini · Apodex 1.0 · mini
早期智能体与推理研究
早期的研究智能体与推理模型工作,包括 MiroFlow、MiroThinker 和 MiroMind-M1,关注工具使用、长程推理与评测。
MiroFlow · MiroThinker · MiroMind-M1 · 综述:100 Days After DeepSeek-R1
音频与多模态大模型
在 A*STAR I²R,我主导 MERaLiON AudioLLM 的数据准备与评测,并共同负责模型训练;主导 AudioBench,覆盖 8 类任务与 26 个数据集。
工作
- 2025 年 5 月至今AI 研究科学家 · Apodex, 新加坡→
从零搭建智能体框架;大规模预训练数据获取与质量评估。
- 2023 年 4 月 – 2025 年 4 月科学家 · MERaLiON 团队技术负责人(数据和评测方向) · 资讯通信研究院 (I²R), A*STAR, 新加坡→
担任 MERaLiON AudioLLM 团队技术负责人(数据和评测方向),聚焦新加坡国家多模态大模型计划下的东南亚音频-语言模型。
- 2021 年 9 月 – 2023 年 3 月博士后研究员 (Research Fellow) · 新加坡国立大学 (NUS)→
构建 FacEval 对话摘要事实一致性评测与 EvalRank 表示评测。导师:李海洲教授。
- 2020 年 5 月 – 2020 年 8 月研究实习 · 京东 AI 研究院 (美国山景城)→
研究常识知识图谱的归纳式补全,与斯坦福大学 Jure Leskovec 课题组合作完成。
- 2016 年 7 月 – 2016 年 10 月研究实习 · 加拿大安大略理工大学→
利用 Kinect 进行三维点云手势识别,用于人机交互;入选 Mitacs Globalink 项目。
获奖
- APSIPA Sadaoki Furui Prize Paper Award(2024)
- APSIPA Sadaoki Furui Prize Paper Award(2022)
- 最佳论文奖,SUMEval Workshop(COLING 2025)
- 最佳论文奖,C3NLP Workshop(ACL 2024)
- USC Graduate Student Government Research Travel Grant(2019)
- 四川省优秀毕业生(2017)
- 本科国家奖学金(2015、2016)
- Mitacs Globalink 研究实习项目(2016)
学术服务
- 出版主席,EMNLP 2023
- 领域主席,ACL ARR(2024–2025)
- 编委,APSIPA Transactions on Signal and Information Processing,2023–2025
- 分会主席,IJCNN 2021
- 审稿:Nature Human Behaviour(2022)、IEEE/ACM TASLP、ACL、EMNLP、NAACL、ICASSP、ICME
学生指导
在 I²R(A*STAR)与新加坡国立大学期间指导 10 位以上研究生与实习生,研究方向包括音频大模型、指令微调、长视频理解;多人已进入知名博士项目或业界研究岗位。
- Apodex 1.1: Scaling Agentic Intelligence for Complex Work· Technical report, Aug 2026· Apodex 团队贡献者
- Apodex-1.0: A Verification-Centric Agent Team for Discoverative Intelligence· Technical report, Jun 2026· Apodex 团队贡献者
- MiroFlow: Towards High-Performance and Robust Open-Source Agent Framework for General Deep Research Tasks· arXiv 2026
- MiroThinker: Pushing the Performance Boundaries of Open-Source Research Agents via Model, Context, and Interactive Scaling· Technical Report 2025
- MiroMind-M1: An Open-Source Advancement in Mathematical Reasoning via Context-Aware Multi-Stage Policy Optimization· Technical Report 2025
- MERaLiON-AudioLLM: Advancing Speech and Language Understanding for Singapore· ACL 2025, System Demonstrations· 共同第一作者
- AudioBench: A Universal Benchmark for Audio Large Language Models· NAACL 2025· 第一作者
- CoinMath: Harnessing the Power of Coding Instruction for Math LLMs· Findings of ACL 2025
- Resilience of Large Language Models for Noisy Instructions· Findings of EMNLP 2024
- SeaEval for Multilingual Foundation Models: From Cross-Lingual Alignment to Cultural Reasoning· NAACL 2024· 共同第一作者
- Knowledge Graph Embedding: An Overview· APSIPA Transactions on Signal and Information Processing, 2024
- An Overview on Language Models: Recent Developments and Outlook· APSIPA Transactions on Signal and Information Processing, 2023
- Compounding Geometric Operations for Knowledge Graph Completion· ACL 2023
- Analyzing and Evaluating Faithfulness in Dialogue Summarization· EMNLP 2022
- Just Rank: Rethinking Evaluation with Word and Sentence Similarities· ACL 2022
- Graph Representation Learning: A Survey· APSIPA Transactions on Signal and Information Processing, 2020
- SBERT-WK: A Sentence Embedding Method by Dissecting BERT-based Word Models· IEEE/ACM TASLP 2020
- Evaluating Word Embedding Models: Methods and Experimental Results· APSIPA Transactions on Signal and Information Processing, 2019
bwang28c@gmail.com