上科大」共找到 6378 篇相关文章

开源动态8

鹏城实验室 X 中hcp实验室推出 RADAR : 具身智能评测的新标杆

RADAR是鹏城实验室与中hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三缺陷,通过创新设计揭示模型不足,为研究者提供方向,推动具身智能实用化。

AI科技评论
算法论文8

EMNLP2025 | 解耦视觉与推理,港探索视觉语言模型"眼智分离"新范式

当前视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
新闻资讯8

对话淘宝姜宇宁:如果你只推低价商品,是不需要用语言模型的

淘宝姜宇宁团队线RecGPT百亿参数推荐模型,对“猜你喜欢”功能技术升级。模型赋予传统推荐系统新能力,如让其“白盒化”、理解长下文等。姜宇宁认为AI要创造商业价值,落到业务场景形成正向循环。

AI科技评论
算法论文7

你永远叫不醒装睡的模型!多轮对话全军覆没,性能暴跌39%

研究人员进行超20万次模拟实验,耗资5000美元,评估模型在多轮对话中的表现。结果显示,模型在多轮对话中性能明显低于单轮对话,平均下降39%,还出现“对话迷失”现象。

新智元
新闻资讯7

小米小爱同学:资源受限下,实现端侧模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,探讨模型端侧部署难题。团队自研推理框架,实现180 tokens/s推理速度,采用共享基座架构支持多业务。未来端侧模型突破依赖硬件提升与架构演进。

AI前线
产品应用7

昇腾910B模型实测:开源框架能不能打?真相全放这了

文章对昇腾 910B 模型进行实测,对比 vLLM Ascend 与 MindIE 在实际推理场景中的性能差异。通过 GPUStack 平台测试多种模型,结果显示两者在不同部署场景各有优势,vLLM 适合单卡小模型,MindIE 适合模型多卡部署。

探索AGI
新闻资讯7

Meta发最强模型打响价格战,小扎对谷歌贴脸开!北校友立

九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升、成本低,性价比高,但也遭质疑,模型下半场或比拼系统架构和智能体工程能力。

新智元
新闻资讯7

Karpathy 秒删 AI 职业分析项目,背后是,一场人类的职业迁移

Karpathy 做了 AI 职业暴露度分析项目,引发关注后秒删。Stanford NLP 指出其分析不足。多家报告显示 AI 对职业冲击,全球技行业裁员,国内前端岗位受影响,还带来职业迁移。

AGI Hunt
新闻资讯8

「全球模型第一股」来了!智谱港交所敲钟,市值达528亿港元

2026年1月8日,智谱登陆港交所,成全球首家以AGI基座模型为核心业务的市公司,市值528.28亿港元。它以‘全球模型第一股’吸引资本,研发强、MaaS模式优,标志中国AGI企业走向资本市场。

新智元
算法论文8

模型转行土木工程!首个「打灰人」评估基准:检验读、改工程图纸能力

首个工程自动化任务评估基准DrafterBench,可测试模型在土木工程图纸修改任务中的表现。它模拟真实工程命令,考察模型四方面能力。评测发现主流模型有一定能力,但未达工程一线要求。

新智元