「自主智能测试」共找到 5160 篇相关文章

开源动态8

一张图生成任意场景3D模型,部分遮挡也不怕|IDEA x 光影焕像联合开源

IDEA研究院张磊团队与香港科技大学谭平团队联合推出SceneMaker框架,以DINO - X与Triverse为基础,实现从任意开放世界图像到带Mesh的3D场景完整重建,解决遮挡难题,有多项创新,应用场景广泛。

量子位
开源动态7

AI用3年时光,来了解你!首个AI Clone长期记忆基准

现有AI记忆评测存在数据源单一、忽视变化本质、注入成本高等局限。开源学术社区QuantaAlpha联合高校团队提出CloneMem基准测试,构建合成人生,设计评测任务,实验发现简单方法在检索上更有效,记忆系统应还原信息。

新智元
推荐文章7

Skills 是短期红利还是长期壁垒?

网友提问,随着基础模型进化,Skills 是否会被自主规划取代,创业者布局 Skills 是短期红利还是长期壁垒。作者认为 Skills 既是短期红利,也是长期壁垒,并用 AI 发展三阶段解释,指出投资 Skills 应关注能力积累。

宝玉AI
开源动态8

蚂蚁再把医疗AI卷出新高度!蚂蚁·安诊儿医疗大模型开源即SOTA

蚂蚁集团联合多方开源的医疗大模型蚂蚁·安诊儿(AntAngelMed),一经发布就登顶多项医疗基准测试榜单,是迄今参数规模最大的开源医疗模型,应用门槛低,为行业示范出一条清晰路径。

量子位
新闻资讯8

字节跳动内部信:大幅调薪+职级洗牌;千问“干死豆包”图疯传,阿里回应;六小龙IPO战打响,MiniMax、智谱率先过聆讯|Q资讯

本文汇总多则科技资讯。如字节跳动调薪并推行新职级体系;阿里回应千问‘干死豆包’图为AI生成;马斯克薪酬方案裁决恢复;OpenAI发布编程模型;小红书、腾讯等也有业务动态。

InfoQ
新闻资讯8

Andrej Karpathy:做个好人,未来的 LLM 正在看着你

Andrej Karpathy 12 月 10 号写 blog,用现在视角为十年前 Hacker News 帖子自动打分,开源代码。他近期多篇文章探讨 LLM 相关,如可验证性、智能空间对比等,还启动 Eureka Labs。他认为未来 LLM 会审视当下行为。

MacTalk
产品应用8

GPT-5.2 发布:做表格、写 PPT、敲代码 | 打工人的生产力利器

GPT - 5.2发布,在GDPval评测等众多基准测试中刷新行业水平。GPT - 5.2 Thinking适合真实场景与专业工作,在知识型任务、编码、长上下文处理、视觉理解、工具调用等方面表现出色,部分功能需付费使用。

AI进修生
开源动态7

AutoGLM深夜开源,千千万万个手机Agent要站起来了。

昨天深夜智谱将手机Agent AutoGLM开源,包含手机端智能助手框架和AutoGLM - Phone - 9B模型。它为解决隐私问题给出中间态解法,有3种部署模式,虽有不足,但让个人拥有本地手机Agent成为可能。

数字生命卡兹克
新闻资讯8

为什么所有企业都在谈 Agent?50+ 技术实践给出真实答案

12月19 - 20日北京举办的AICon全球人工智能开发与应用大会,聚焦AI Agent等关键方向。来自腾讯等企业的实践者将分享构建智能系统经验,大会设Keynote和12大平行技术专场,呈现AI技术全景。

PaperAgent
新闻资讯7

「小米们」的百镜大战,带火国产眼镜老板

今年10月以来,AI、AR眼镜迎新品发布期,双11销售大增,带火眼镜制造商和零售商。传统眼镜厂商受益于配镜需求和高利润率,但也面临价值量少、选择多等问题,且难成持续增长主力曲线。

芯师爷