观测的暴露度」共找到 10599 篇相关文章

新闻资讯8

Opus 5通关ARC-AGI-3!Harness正在变成捆住模型绳子

ARC Prize官方给Opus 5ARC - AGI - 3成绩为30.2%,但开发者Jeremy Berman让其借助电脑,正确率飙升至96.2%。还开源代码,换用Codex等测试效果差。表明模型强时,简单环境更佳。

新智元
产品应用8

Claude Fable 5怎么用?Anthropic 工程师:干你也不知道

AnthropicClaude Code工程师Thariq Shihipar发长文介绍Fable 5使用方法。他认为与Fable 5协作要发现未知,其定位解决复杂问题。还将未知分类,给出任务前中后打法,并举例用Fable 5剪视频。

AIGC开放社区
推荐文章8

万字长谈丨同济工智院华先胜:工程智能,是 AI 「成人礼」

雷峰网·AI科技评论对话同济工智院华先胜,探讨工程智能。他认为工程智能是AI与工程深度融合,要从数字走向物理世界,构建体系,实现人机共生,还介绍了研究院成果、灵感计算及操作系统架构等。

AI科技评论
新闻资讯8

最新!Karpathy:Vibe Coding只是抬高了地板,真正战场在这里

Andrej Karpathy在AI Ascent 2026上与红杉合伙人对话,分享自提出“vibe coding”一年来变化。谈到技术转变、Software 3.0、模型“锯齿状”特征等,还区分了vibe coding和agentic engineering,指出人类需保留品味、判断力等。

AI寒武纪
产品应用8

手撕、翻滚、暴力砸地!最「扛造」灵巧手来了

4月17日智元合作伙伴大会上,临界点AGILINK发布三款新品,包括旗舰级工业绳驱灵巧手OmniHand 3 Ultra - T、普惠型耐造小手OmniHand 3 Lite和全面焕新具身夹爪OmniPicker 3,各有优势且兼顾量产与开源。

机器之心
算法论文8

多模态幻觉病因「高熵节点」找到了!全基准幻觉率下降

多模态大推理模型幻觉常出现在生成转折词时,此时模型处于高熵关键节点,易脱离图像证据。研究者提出LEAD,高熵时保留候选推理方向,注入视觉锚点拉回证据,实验显示它能跨领域提升模型性能。

新智元
推荐文章7

企业AI智能体大排雷:138场顶级分享抖出落地实情

AI智能体重塑软件工程,研究团队分析138场演讲发现搭建时精力多花在工程集成和接口对接。文章结合推理模型与人工校验,介绍企业引入智能体架构策略、演进历程、应用差异及技术底座等内容。

AIGC开放社区
算法论文8

用SFT打出RL效果?微软联合提出高效后训练算法

大模型后训练阶段,SFT 和 RL 各有优劣。微软等联合提出新工作,量化 SFT 和 RL 在数据层面差距,提出 IDFT 和 Hinted Decoding 等高效后训练技术,实验显示新方法泛化超 SFT、效率超 RL。

机器之心
算法论文8

CL-Bench故事没有结束,生成式CL-Bench:GENIUS来了

北大团队发布GENIUS,用于评估模型生成式流体智力。它构建含510个样本、20个子任务评测集,测试模型多方面能力。实验显示当前模型流体智力有短板,还提出免训练注意力校准机制提升性能。

机器之心
开源动态8

LTX-2开源:首个能同时生成视频和音频模型

LTX-2开源,它是Lightricks团队开发首个开源多模态基础模型,能联合生成音频和视频。采用非对称双流扩散变换器架构,用深度多语言文本编码器,速度比许多纯视频开源模型快,让模型理解声画关联。

AI工程化