评测领先」共找到 1022 篇相关文章

新闻资讯8

100个产品原型同时跑、新模型Mythos断层领先,连skills效果都好到让团队意外:Anthropic内部到底在发生什么?

Claude Cowork 工程负责人 Felix Rieseberg 在播客中透露,未发布的新模型 Mythos Preview 带来“断层式跃迁”,在安全漏洞检测等方面表现出色。Anthropic 内部可同时跑上百个产品原型,执行成本降低。还介绍了 Cowork 开发、应用及产品打造经验。

InfoQ
7

史上最高种子轮花落AI:20亿美元断档领先,苹果Meta抢着都投不进,扎克伯格转头挖联创也遭拒

OpenAI前CTO创办的Thinking Machines完成20亿美元种子轮融资,刷新AI领域融资纪录。此前苹果和Meta曾试图投资或收购该公司,均被创始人Mira Murati拒绝。本轮融资由Andreessen Horowitz领投,估值达100亿美元。

量子位
开源动态8

大模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一

多个机构研究人员联合发布全新多语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有大模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试。

量子位
新闻资讯7

Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?

Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。

AI科技评论
算法论文8

用3D几何先验驱动视频扩散,实现更一致的世界生成

视频扩散模型生成新视角视频时,现有方法缺显式3D结构。智象未来提出DreamWorld,用3D先验与两阶段框架,结合结构和生成能力,在多基准测试表现领先

机器之心
新闻资讯7

毛利率53%!光刻机之王的AI红利

4月15日阿斯麦发布2026年第一季度财报,净销售额、毛利率、净利润均超预期。管理层上调全年业绩指引,其因订单饱满、AI驱动、技术独供等持续领先,还计划提升产量。

芯师爷
算法论文8

ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

现有第一人称视频助手难以自主判断何时介入服务用户。大连理工大学等团队提出Vinci2,含评测基准EgoServe和智能体EgoMemo。它已被ECCV 2026接收,代码和标注均开源。

机器之心
产品应用8

刚刚,Thinking Machines出手!首款交互模型来了,翁荔出镜实测

Thinking Machines Lab推出首个大模型TML - Interaction - Small,打破传统人机交互模式,实现全自然交互。它训练范式独特,采用双模型架构等设计,评测表现超GPT - Realtime 2.0等模型,后续还会推出更大尺寸模型。

机器之心
产品应用8

π0引用的中国团队,又出手了:世界仿真器新作发布

Current Robotics团队发布交互式世界仿真器CurrentWorld - 0,创始人祝毅晨履历亮眼。该仿真器能跨本体、多视角、力 - 触觉预测,可用于评测机器人,还能让人类接管以探索不同动作结果。

量子位
新闻资讯7

刚刚,Anthropic 又出新货:Claude Opus 4.1 发布,代码、推理能力再升级

Anthropic发布Claude Opus 4.1,是对Opus 4的小升级,提升智能体任务、代码处理和推理能力。付费Claude用户等已可用,价格不变。在编程评测表现佳,获多方好评,官方建议升级。

AI进修生