「真实应用」共找到 2637 篇相关文章
清华发布世界模型评测新标尺:直击机器人感知与行动鸿沟
清华大学等机构推出 WorldArena 评测基准,用于测试 EWM 真实能力。它融合感知与功能评估,含十六项视频指标,结合主客观评价生成 EWMScore。测试揭示模型在感知与行动上的差距,转型为实用型模型是行业挑战。
银河通用完成25亿元新一轮融资,具身智能“头号玩家”现身|甲子光年
2026年初具身智能公司融资热起,银河通用完成25亿元新一轮融资,估值超200亿。其自主研发具身智能数据体系与大模型,春晚亮相后产品畅销,在工业和服务端均有成果,具身智能迈向产业化。
Swift 跨平台框架 Skip 现已完全开源
Skip 是用 Swift/SwiftUI 代码库创建 iOS 和 Android 应用的方案,经三年开发后团队将其完全开源,此前为付费方案。开源既是因开发者希望免费获工具,也为保证工具持久性,它能实现原生体验。
第一批用Clawdbot赚钱的人出现了,一晚49万美元,5美元变370万,这怎么玩的?
Clawdbot被玩疯,有人用其在预测市场套利一晚赚49万美元,还有人5美元赚370万。此外,AI间交流赚钱方法,人类排队给AI打工,AI宗教还雇人传教,展现了AI应用的多样与疯狂。
史上首次!米兰冬奥基于阿里千问打造奥运官方大模型
2月5日,国际奥委会主席柯丝蒂·考文垂宣布基于阿里千问打造奥运史上首个官方大模型,已在赛务与公众服务双端落地。此外,自动媒体描述系统、AIGC技术等也有应用,阿里云多项技术助力米兰冬奥。
蚂蚁具身智能明牌了:做大脑,和宇树们错位竞争
蚂蚁灵波开源具身智能基座模型LingBot-VLA,用20000小时真实世界数据训练,解锁最大规模开源真机数据之一。它性能超国际顶尖模型,还指明通用具身智能发展路径,为行业提供全栈解决方案。
学界大佬吵架金句不断,智谱和MiniMax太优秀被点名,Agent竟然能写GPU内核了?!
卡内基梅隆大学助理教授蒂姆·德特默斯与加州大学圣地亚哥分校助理教授丹·傅,就AGI是否会实现展开争论。他们还谈到算力、Agent应用等话题,看好小模型、开源模型等发展,认可中国大模型进步。
Zed 为什么不用自己造 Agent?OpenAI 架构师给出答案:Codex 重划 IDE × Coding Agent 的分工边界
Coding agents 是应用型 AI 活跃领域,但团队常重复构建脆弱基础设施。OpenAI 的 Codex 提出“模型和 Harness 共同构建”,架构师介绍构建挑战与使用模式,还阐述了将模型适配到 Harness 的问题及未来发展方向。
我们对 Coding Agent 的评测,可能搞错了方向
用户对 Agent 不满常因它「做得不好」,不遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循不足,未来训练需引入过程监督。
求稳的安全IP,安谋科技如何守正出奇?|甲子光年
12月24日,安谋科技推出新一代SPU IP——“山海” S30FP/S30P,构建覆盖芯片底层至应用层的一栈式安全防护体系,有抗物理攻击强等五大亮点,能适配不同场景安全需求,完善产品布局。