混元3D 2.1」共找到 3848 篇相关文章

8

刚刚,中国AI闯入全球编程前二!前面只剩Claude

Code Arena最新榜单出炉,Qwen3.7 - Max以1541分冲进全球第四,是前五中唯一非Claude模型。它在多项测试中表现出色,是为长时间自主执行任务设计的Agent基座模型,编程跃升或与环境扩展、长程自主执行训练方法升级有关。

新智元
算法论文8

Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型

文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。

机器学习AI算法工程
新闻资讯7

Claude不到4%,全军覆没!一场大考撕碎Agent「全自动办公」幻想

新智报道,UniPat AI的SaaS - Bench实战考卷,用23个真系统、106个任务测试Agent。结果显示,Claude Opus 4.7完全通过分数仅3.8%,多数模型全军覆没,暴露了Agent在真实环境中的四种致命缺陷。

新智元
新闻资讯7

蚂蚁技术研究院副院长吕乐当选美国医学与生物工程院(AIMBE)Fellow

美国医学与生物工程院(AIMBE)公布2026届Fellow入选名单,蚂蚁集团技术研究院副院长吕乐博士当选。该机构Fellow评选是领域最高荣誉之一,仅授予全球前2%顶尖人才。吕乐在医疗AI贡献突出。

AI科技评论
新闻资讯7

这家初创要为AI重绘地球:可量身定制卫星星座,对接太空计算

西班牙初创公司 Xoople 完成 1.3 亿美 B 轮融资,欲构建“地球记录系统”。它先铺管道、再造源头,与 L3Harris 合作开发天基测量系统,虽面临竞争与隐忧,但也顺应太空计算融合趋势。

DeepTech深科技
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的可信验证框架

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。

机器之心
算法论文8

1个Token测出模型降级调包!成本砍到千分之一,API供应商的小伎俩全曝光了

法国研究人员开发新检测技术,能识别云端模型隐秘变动。对数概率追踪用于灰盒环境,成本仅传统千分之一;黑盒边界输入追踪用于黑盒环境,成本为先进方案1/30。这些工具让API供应商“调包”行为现形。

量子位
新闻资讯8

黄仁勋,开启智(Token)时代

全球大模型进入千万亿智(Token)时代,OpenRouter年化智用量突破一千万亿,对应推理支出约10亿美。黄仁勋在GTC大会提出「智(Token)经济学」,智成AI时代核心经济标尺,重塑产业规则。

新智元
新闻资讯7

全网都在扒的小米MiMo团队,几乎被“北大学子”承包了

小米MiMo-V2-Pro模型登上OpenRouter调用量榜单第一后,网友关注其团队。该团队成立一两年冲到顶尖,核心作者多来自北大,技术理念受小米产品基因驱动,成功是多重因素叠加结果。

量子位
产品应用8

构建会思考的测试Agent:从自动化到自主智能的演进

文章介绍面向企业级软件测试的质量数字人系统,结合大语言模型等实现从传统到自主智能测试跨越。分析专有云测试困境,指出通用AI Agent平台局限,阐述系统设计、能力及架构,展示应用成果并展望扩展场景与未来计划。

阿里云开发者