文章来源:放心AI网发布时间:2025-04-20 11:30:13
微软在其官网上正式发布了多模态 AI Agent 基础模型 “Magma”,并进行了开源。这一新兴技术相较于传统的智能助手,展现出了更为强大的多模态能力,能够处理图像、视频、文本等多种数据形式,打破了数字与物理世界之间的壁垒。
Magma 不仅可以帮助用户在电商平台上自动下单,查询天气等日常事务,还能与实体机器人协作,执行更复杂的操作。比如,在下真实象棋时,Magma 能够为用户提供实时的策略建议,大大增强了游戏体验。同时,它具备心理预测功能,能够推测视频中的人物或物体的未来行为,让虚拟助手或机器人更好地理解周围的动态环境并做出相应反应。
根据官方介绍,Magma 的应用场景非常广泛。它不仅能帮助家用机器人学习如何整理那些它从未见过的物品,还能为虚拟助手生成不熟悉任务的逐步用户界面导航说明。这样的功能,使得用户在面对新环境或新任务时,能得到更为精准的帮助和指引。
Magma 是属于视觉语言动作(VLA)基础模型的一部分,能够通过海量公开视觉和语言数据进行学习。这一能力使得 Magma 能有效融合语言、空间和时间智能,为用户在数字与物理世界中的复杂任务提供解决方案。
Magma 的开源为开发者和研究人员提供了一个强大的工具,促进了智能助手和家用机器人的进一步发展。未来,随着这一技术的不断完善,我们或许能够在日常生活中看到更多基于 Magma 的创新应用。
项目地址:https://microsoft.github.io/Magma/
上一篇: 智元机器人AgiBotDigitalWorld仿真框架上线,数据集丰富多样
智元机器人今日正式宣布推出自主研发的大型仿真框架AgiBot Digital World,为机器人操作提供灵活的仿真数据生成方案、预训练的大规模仿真数据和统一的模型评测标准,并同步开源海量仿真数据。AgiBot Digital Worl
下一篇: OpenAI免费开放ChatGPT高级语音聊天模式基于GPT-4omini
2月26日,OpenAI公司在X平台发布推文,正式向广大用户宣布,即日起将免费开放ChatGPT的高级语音模式(Advanced Voice Mode)。据悉,ChatGPT的高级语音模式基于GPT-4o mini模型,通过优化计算效率,在性能方面已
相关攻略 更多
最新资讯 更多
AI语音独角兽ElevenLabs完成2.5亿美元C轮融资,估值突破30亿
更新时间:2025-04-29
百川智能推出国内首个全场景深度思考医疗大模型,革新医学推理方式
更新时间:2025-04-29
奥特曼加码长寿科技:RetroBiosciences欲筹10亿美元,挑战人类寿命极限
更新时间:2025-04-29
OpenAI新成立的PBC部门估值达300亿美元,微软投资股份尚未确定
更新时间:2025-04-29
扎克伯格表示,2025年底Meta将拥有130万个用于AI的GPU
更新时间:2025-04-29
德勤:企业在推行生成式AI项目上面临规模化挑战
更新时间:2025-04-29
AI基础设施争夺战愈演愈烈:OpenAI与微软的微妙关系
更新时间:2025-04-29
聊天机器人平台CharacterAI以第一修正案为由申请驳回与青少年自杀案的诉讼
更新时间:2025-04-29
Deezer日均上传超万首AI音乐,平台开始检测与标记
更新时间:2025-04-29
AI创业公司GameOn创始人与律师妻子被控6000万美元投资诈骗
更新时间:2025-04-29