大厂壁垒」共找到 5147 篇相关文章

开源动态8

打破模型编程「数据污染」与「能力虚胖」困境,Meituan-M17团队构建新一代AI编程评测新标准——OIBench

当前语言模型编程能力评估体系问题多,如评测集饱和、数据泄漏等。Meituan - M17团队推出OIBench数据集,对18个主流模型评测,揭示模型真实水平,还将举办人机协作编程竞赛。

机器之心
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把模型「塞进」小设备?| IJCAI 2026

IJCAI 2026会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三挑战。

AI科技评论
产品应用7

高考数学全卷重赛!一道题难倒所有模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态模型。

机器之心
新闻资讯7

模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验模型创造性推理能力。结果显示模型总体正确率仅15%,9×9数独中高性能模型o3 Mini High正确率2.9%。

量子位
产品应用8

杀疯了!单卡4090跑通全量微调,面壁1B级多模态性能怪兽硬刚

面壁智能推出MiniCPM-V 4.6,参数约1B,性能和推理效率出色。它在多模态任务综合能力、推理速度上领先竞品,靠ViT架构改造和4倍/16倍混合视觉Token压缩实现创新,有工业验证,对开发者和普通用户意义

AI寒武纪
开源动态8

小红书开源模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……

小红书hi lab团队公布首个开源模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。

AGI Hunt
开源动态8

不会拍照有招了!北彭宇新团队开源首个美学指导模型Venus,帮你拍好照|CVPR 2026

彭宇新教授团队针对现有模型在摄影指导上的不足,定义美学指导任务,构建数据集AesGuide,提出美学指导模型Venus。相关论文被CVPR 2026接收并已开源,Venus在多项评测中优于现有方法。

量子位
新闻资讯8

中国团队引领太空算力:首次太空在轨部署通用模型,发2800颗卫星服务数亿硅基智能体

岁末年初,全球AI竞争聚焦太空算力,中美你追我赶。美国Starcloud宣布在太空跑通模型,中国国星宇航发布全球首个服务硅基智能体的太空算力网,计划用2800颗卫星服务数亿个硅基智能体,还实现通用模型在轨部署。

量子位
新闻资讯8

模型中标TOP10里的黑马:中关村科金的应用攻坚之道

2025 年中国模型产业招投标市场爆发,应用类项目占比近六成。中关村科金以 23 个中标项目入围应用类 TOP10,在多行业落地成果显著。2026 年行业将聚焦 ROI、数据壁垒等方面。

机器之心
新闻资讯8

刚刚,小扎成立「超级智能实验室」!11人豪华阵容曝光,华人占多半

小扎官宣Meta「超级智能实验室」(MSL)成立,合并内部三AI团队,28岁Alexandr Wang任首席AI官,公布11人豪华团队名单,团队多来自谷歌、OpenAI等,目标开发超级智能。

新智元