权威评测」共找到 698 篇相关文章

推荐文章7

公司官网没用了?AI搜索让它变得前所未有的重要!

本文围绕AI搜索时代公司官网的重要性展开。指出国内官网流量减少是因搜索流量迁移,而在AI时代官网成重要信源。还阐述官网作用变化、AI友好内容标准、页面优化重点及应注重信任标签。

白杨SEO优化教程
新闻资讯8

在ICLR 2026主会之前,我们和30多位入选者聊了聊最前沿的AI细节

4月14日,智源社区、DeepTech联合举办ICLR 2026预讲会。会议聚焦顶会核心精华,三十余位论文作者分享AI Agent、大语言模型等热门领域成果,展示解决大模型痛点的研究。

DeepTech深科技
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心
新闻资讯7

“龙虾”时代,大模型公司的好日子来了

3月10日,MiniMax港股收涨,市值超百度。OpenClaw爆火,其创始人转发评测榜单,使MiniMax-M2.1排名突出。OpenClaw是智能体构建框架,为大模型公司带来盈利转机,撬开收入天花板,引发各方关注。

远川科技评论
产品应用7

Perplexity不仅没死,而且很强

文章对比通用AI搜索与Perplexity,指出通用AI搜索用于金融投资不够严谨准确,而Perplexity从专业金融API拉取数据,集成权威数据源,准确度高。在此基础上推出的Perplexity Computer功能强大,是严肃工具。

newtype AI
算法论文8

nnU-Net:医学图像分割的自适应自动化框架

德国癌症研究中心团队提出 nnU-Net 自配置医学图像分割框架,能根据数据集特征自动推导预处理、网络拓扑等策略获稳健分割基线。文章介绍其原理、优缺点、评测案例及 Python 代码实现。

机器学习AI算法工程
开源动态8

阿里达摩院开源具身大脑基模:3B激活参数性能超越72B,转身就忘事的机器人有救了

阿里达摩院开源RynnBrain具身大脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项具身Benchmark上超顶尖模型。具小而美优势,训练用自研架构提效,数据丰富,输入输出灵活。

量子位
开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!

当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。

MCP Server
算法论文8

拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?

现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。

机器之心
开源动态7

让 AI 像真人一样操控手机完成各种复杂任务

MobiAgent是强大的移动端智能体系统,含智能体模型家族、加速框架、评测基准。能让AI像真人操控手机完成复杂任务,提供开箱即用App,内置经验检索模块可自动优化规划。

GitHubStore