它石智航」共找到 4518 篇相关文章

算法论文8

训练数据爆减至1/1200!清华&生数发布国产视频具身基座模型,高效泛化复杂物理操作达SOTA水平

清华大学与生数科技联合研发Vidar模型,首次让通用视频大模型长出‘手脚’,实现从虚拟到真实世界物理执行的跨越。降低数据门槛,突破跨本体泛化困境,为服务机器人应用奠定基础。

量子位
产品应用7

腾讯无极低代码平台打开MCP之外的新思路:多模态聊天

腾讯无极低代码平台提出‘前端多模态智能’概念,让AI输出内容更多样,可嵌入交互页面片。还给出四步配置法实现‘多模态聊天’,与MCP形成互补,能增强信息交互和用户掌控感。

腾讯技术工程
新闻资讯7

代码碾压一切!OpenAI神秘模型o3-alpha一夜刷屏,却遭41岁大神绝地反杀

OpenAI神秘模型o3 - alpha曝光,代码能力强大,疑似在编程大赛获亚军,不敌人类选手Psyho。ChatGPT Agent也实力惊人。比赛组织者指出AI代码优化强,但缺人类创造力。

新智元
新闻资讯7

OpenAI新Agent遭中国24人初创团队碾压!实测成本、质量全输惨,海外用户:中国Agent代差领先

昨日凌晨,OpenAI推出ChatGPT Agent新功能,标志其踏入“智能体人工智能”领域。虽官方称该功能性能先进,但实际效果有局限。海外网友对比发现,被中国24人初创团队产品Genspark等碾压。

InfoQ
算法论文8

大模型转行土木工程!首个「打灰人」评估基准:检验读、改工程图纸能力

首个工程自动化任务评估基准DrafterBench,可测试大模型在土木工程图纸修改任务中的表现。模拟真实工程命令,考察模型四方面能力。评测发现主流大模型有一定能力,但未达工程一线要求。

新智元
产品应用7

小哥硬核手搓AI桌宠!接入GPT-4o,听得懂人话还能互动,方案可复现

国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,手搓AI桌宠Shoggoth,接入GPT - 4o,能与人互动。结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。

量子位
开源动态7

数千大模型全跑「中国芯」!最后一公里已「焊」通

国产芯片运行大模型需额外适配,魔乐社区以开源模型推理适配协作模式破局。推出‘模型推理适配协作计划’,联合多方力量,打通国产算力与大模型应用‘最后一公里’,还举办赛事激发创新活力。

新智元
新闻资讯7

Grok 4刷新ARC-AGI-2纪录:15.9%碾压所有公开模型,我们离AGI还有多远?

xAI的Grok 4在ARC-AGI-2测试中获15.9%,成全球最强公开AI模型。ARC Prize主席还原测试过程,虽成绩亮眼,但网友有质疑,且离人类表现差距大。Grok 4在多基准测试领先,定价便宜。

AGI Hunt
算法论文8

AI"学霸"也解不出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板

耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。有高质量数据、多模态多题型测试和精细知识分类体系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。

深度学习自然语言处理
新闻资讯7

估值200亿,小米、宁德时代看中的半导体独角兽冲刺IPO

6月30日,芯迈半导体递表港交所拟上市。该公司专注功率半导体,获小米、宁德时代等投资,估值达200亿。不过近三年营收下滑、亏损加大,依赖大客户,此次IPO有“输血”意味,扭亏是核心问题。

芯师爷