测试套件规模」共找到 2142 篇相关文章

算法论文8

AI一眼认出95万物种,还能分辨雄雌老幼,2亿生物图像炼成“生命视觉”大模型

俄亥俄州立大学团队用2亿生物图像训练BioCLIP 2模型,取得最优物种识别性能。它在无相应监督信号的非物种任务中,准确率远超DINOv2,还涌现出物种间生态对齐、物种内差异分离等生物学理解。

量子位
新闻资讯7

首个氛围编码公司收购案诞生!成立 180 天 0 融资,仅有 8 名员工,却卖了 5 个亿

Wix 周三宣布,以 8000 万美元现金收购独立开发者 Maor Shlomo 成立仅六个月的氛围编码初创公司 Base44。该公司 8 名员工将获 2500 万美元“留任”奖金。Base44 用户增长快且已盈利。

InfoQ
开源动态8

智元机器人发布并开源首个机器人动作序列驱动的世界模型

近日,智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,打破具身智能演进制约。

AI前线
新闻资讯7

Shopify CEO考虑禁用Claude Code,因其不兼容AGENTS.md

Shopify CEO Tobi Lütke 考虑在 Shopify 禁用 Claude Code,因其坚持读取`CLAUDE.md`,与团队常用的`AGENTS.md`等不兼容,可能使开发者获不同项目规则。开发者社区给出解决办法,Lütke仍担忧大规模维护难题,Claude Code 团队称会跟进。

机器之心
新闻资讯7

中科院自动化所孵化的矿山物理AI龙头,国家队与产业资本为何集体重仓|甲子光年

2026年物理AI热度攀升,概念也趋于泛化,产业和资本更关注其实际价值。矿山场景或成Physical AI首个盈利点。中科慧拓由中科院自动化所孵化,其平行矿山方案已落地近50座国内矿山,并实现海外项目落地。

甲子光年
产品应用8

Deepseek V4 Pro深夜上线,性能追平Fable 5,但价格只有它的2%

2026年8月12日,DeepSeek V4 Pro正式版上线。它是混合专家模型,规模居世界第一梯队。价格比Claude Fable 5便宜超98%,成本优势明显。其架构节省成本,API开放多模式,产品结构清晰。

DeepTech深科技
产品应用8

九章云极发布AI工厂体系:破解140万亿Token时代的落地悖论|甲子光年

九章云极于6月17日发布Alaya NeW AI工厂体系,锚定十万P算力、十万亿Token、千个模型、千倍降本四大目标。该体系是智能工业化的必然产物,能解决资源难转生产力的难题,还具备技术效能、生态范式和商业飞轮三大支柱。

甲子光年
产品应用7

Skill Factory:三天手搓面向Harness设计的技能工厂(附AI coding实践)

作者分享从产品设计到算法落地全流程实践,指出当前做skill两种方式的问题,介绍面向Harness设计的技能工厂,包括生产模式、生态适配、迭代方向,还提及AI coding实践及各工具作用。

阿里云开发者
新闻资讯8

北大校友Lilian Weng出镜,爆出120亿估值首个交互模型!

北大校友Lilian Weng出镜介绍Thinking Machines的交互模型,此模型200毫秒神同步,能感知协作。该公司此前获20亿美元种子轮融资,估值达120亿美元。模型打破传统交互局限,或改变人机互动方式。

新智元
算法论文8

DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角

DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。

AI寒武纪