General Intuition等机构开源MIRA,用RAE构建实时多玩家交互世界模型
ICLR 2026 | 交互的两个大模型,内部表征会“同步”?
ICML 2026 | CausalGame:在游戏化交互中评测LLM智能体的因果思维
Talk预告 | 上海人工智能实验室周云松:在世界模型中植入物理知识,实现可扩展机器人学习
SIGGRAPH 2026 | VeraRetouch:多任务推理式照片修图框架
回顾|一场闺蜜式夜谈:读懂学术界女性研究者的坚守与焦虑
直播 | 对话CCF优博、南开大学教授范登平:聊聊“ CCF优博筹备分享”
报名|陈天行 × 陈昭熹 × 戴若犁 × 龚超慧 × 李弘扬:不同来路的具身创业者闭门聊天局
Google DeepMind提出AsyncPatch Diffusion,支持异步生成、原生补全与自适应采样
CVPR 2026 | 拒绝堆算力,vivo开源首个4K超高清编辑数据集VINS-120K
NVIDIA联合港大提出COMPACT-VA,用规划对齐压缩提升长上下文自动驾驶决策性能
全球 AI 漫游指南 | 从千年前圣咏到现代音乐节,AI 正在重新定义音乐
ECCV 2026|不再无脑融合RGB:InfraNet用质量感知引导提升红外目标检测
报名倒计时:六位女性青年教师的闭门交流
直播预告 | NEO 系列:迈向统一的端到端原生多模态智能
NewEyes AI正式上线,源自硅谷斯坦福视觉智能技术的端云协同多模态Agent
Princeton提出COMET,用上下文与多重性分解多模态大模型不确定性
UIUC联合斯坦福、NVIDIA和MIT提出RecursiveMAS,让多智能体系统在潜空间中递归协作
1.13亿数据17语种,MonkeyOCRv2想给视觉文档补上一块公共底座
将门企业月报 | 迪英加、帷幄、智象未来、幺正量子先后完成新一轮融资
General Intuition等机构开源MIRA,用RAE构建实时多玩家交互世界模型
ICLR 2026 | 交互的两个大模型,内部表征会“同步”?
ICML 2026 | CausalGame:在游戏化交互中评测LLM智能体的因果思维
Talk预告 | 上海人工智能实验室周云松:在世界模型中植入物理知识,实现可扩展机器人学习
SIGGRAPH 2026 | VeraRetouch:多任务推理式照片修图框架
回顾|一场闺蜜式夜谈:读懂学术界女性研究者的坚守与焦虑
直播 | 对话CCF优博、南开大学教授范登平:聊聊“ CCF优博筹备分享”
报名|陈天行 × 陈昭熹 × 戴若犁 × 龚超慧 × 李弘扬:不同来路的具身创业者闭门聊天局
Google DeepMind提出AsyncPatch Diffusion,支持异步生成、原生补全与自适应采样
CVPR 2026 | 拒绝堆算力,vivo开源首个4K超高清编辑数据集VINS-120K
NVIDIA联合港大提出COMPACT-VA,用规划对齐压缩提升长上下文自动驾驶决策性能
全球 AI 漫游指南 | 从千年前圣咏到现代音乐节,AI 正在重新定义音乐
ECCV 2026|不再无脑融合RGB:InfraNet用质量感知引导提升红外目标检测
报名倒计时:六位女性青年教师的闭门交流
直播预告 | NEO 系列:迈向统一的端到端原生多模态智能
NewEyes AI正式上线,源自硅谷斯坦福视觉智能技术的端云协同多模态Agent
Princeton提出COMET,用上下文与多重性分解多模态大模型不确定性
UIUC联合斯坦福、NVIDIA和MIT提出RecursiveMAS,让多智能体系统在潜空间中递归协作
1.13亿数据17语种,MonkeyOCRv2想给视觉文档补上一块公共底座
将门企业月报 | 迪英加、帷幄、智象未来、幺正量子先后完成新一轮融资