科技评价体系」共找到 1517 篇相关文章

开源动态8

商汤SenseNova U1深度拆解,原生统一架构终结缝合时代

文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。

机器之心
产品应用8

跨越智能体落地的可信鸿沟:玄甲(AgentWard)全链路防御操作系统正式发布

大模型向自主智能体演进,安全威胁全域化。当前安全方案有局限,制约产业落地。清华大学团队推出玄甲全链路安全防御操作系统,构建五层纵深防御体系,已落地应用,降低安全事件发生率,筑牢安全防线。

机器之心
开源动态7

这脑洞神了!两AI「互喷」,竟治好祖传科研软件95%老毛病?

科学计算领域开源工具多,但大多难以直接运行,制约AI4S与Agentic Science发展。深势科技推出Deploy - Master,以执行为中心,经搜索和构建,将约50万个仓库筛选收敛,构建成功率达95%以上。

新智元
产品应用8

AI 代码审查再进化:AutoDev 多智能体协作架构深度解析

现代软件开发中,代码审查存在信息割裂、人工效率低等痛点。AutoDev 借助多智能体协作与信息聚合,实现从分析到修复的闭环智能流程,还构建多 Agent 协作体系,未来将集成更多能力。

phodal
算法论文8

首个GUI多模态大模型智能体可信评测框架+基准:MLA-Trust

MLA-Trust 是首个针对 GUI 环境下多模态大模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。

机器之心
新闻资讯7

硅谷亲手砸掉自己饭碗?930万岗位正进入AI风险区

Tufts大学发布全美首个「AI就业风险指数」,显示未来2 - 5年,美国约930万个岗位面临被AI替代风险,硅谷等科技重镇首当其冲。高技能、知识密集型职业风险高,而低薪职业相对安全。

新智元
算法论文8

陈丹琦新作:大模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越大模型,推理更像人类。

量子位
开源动态8

具身智能从此「边听边说」,智源研究院开源原生全双工语音大模型RoboBrain-Audio

北京智源研究院联合多方发布原生全双工语音对话大模型 RoboBrain - Audio,采用新架构和创新训练范式,在性能上全面领先,革新音频 - 文本对齐方式,丰富了 RoboBrain 全栈体系,推动具身智能发展。

机器之心
开源动态8

空间智能卡脖子难题被杭州攻克!难倒GPT-5后,六小龙企业出手了

杭州群核科技发布空间大模型,深耕室内场景,直指‘空间一致性’痛点。其开源子模型具真实感全息漫游、可交互等特点。当前空间模型处早期,群核提出‘三位一体’战略,还将开源促行业发展。

量子位
算法论文8

国产芯片比英伟达整体效率更高!?华为 CloudMatrix384 超节点首曝论文,跑 DeepSeek 效率超越英伟达

今年4月,网上曾争论华为芯片效率是否超国际主流。近日华为团队论文公开,阐述在CloudMatrix 384超节点部署DeepSeek大模型细节,性能指标超英伟达体系,还介绍架构、软件栈及适配优化方案。

InfoQ