环境模拟器」共找到 926 篇相关文章

推荐文章7

Harness 工程就是控制论

文章指出OpenAI的Harness工程模式与瓦特离心式调速、Kubernetes类似,都遵循控制论。代码库此前反馈回路在低层面,大语言模型改变现状,但需校准传感和执行,忽视工程实践代价会变得无法承受。

宝玉AI
新闻资讯7

Runway重夺全球第一!1247分碾压谷歌Veo3,没有千亿算力也能干翻科技巨头

Runway Gen - 4.5击败谷歌Veo3,以1247的ELO分数在Artificial Analysis榜单中重夺AI视频王座。它在多方面树立新标杆,虽有局限,但创始人认为其是通用模拟引擎,应用场景广泛。

新智元
新闻资讯7

Who’s Adam?最逆天的NeurIPS评审出炉了

这两天大家收到NeurIPS 2025评审结果,网上现逆天评审意见,把Adam优化当成拼写错误。投稿量飙升致审稿质量难保证,AI评审成普遍现象,还推荐了写反驳意见的博客。

机器之心
算法论文8

文本分类重大创新:持续学习新增类别,不会灾难遗忘

在生成环境中,传统文本分类方法新增业务标签需从头训练,易致知识灾难性遗忘。今天介绍的自适应分类,通过四项创新,可实现动态类添加和持续学习,而不会发生灾难性遗忘。

CourseAI
算法论文8

AI修Bug新SOTA:SWE-Bench Lite60.33%修复率,像人一样能积累经验,中科院软件所出品

ExpeRepair是中科院软件所团队推出的仓库级缺陷修复系统,模拟人类认知的情景和语义两种记忆模式,能积累经验。在SWE - Bench Lite评测中,其Claude - 4+o4 - mini组合修复率达60.3%居首。

量子位
开源动态8

月之暗面刚开源多模态Kimi-2506:智能体、视觉理解,重磅大升级

国内月之暗面平台对开源多模态模型Kimi-VL-A3B-Thinking升级到2506版本。该版本性能、视觉理解等能力提升,支持更高分辨率,在多领域表现出色,还介绍了模型组成与优化改进。

AIGC开放社区
算法论文8

首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈

厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成与求解共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。

机器之心
算法论文8

Apple发布新SOTA Manzano:混合Tokenizer破解多模态统一难题,理解与生成双翼齐飞

多模态AI前景广,但现有模型在理解和生成任务上存在性能冲突。苹果提出Manzano模型,用混合视觉标记降低任务冲突,结构简单可扩展,在多基准测试达SoTA水平,还展示图像编辑潜力。

深度学习自然语言处理
新闻资讯7

微软AI CEO警告:我们需要警惕「看似有意识的AI」

微软AI CEO Mustafa Suleyman提出「看似有意识的AI」(SCAI)概念,它能模拟人类意识外部标志,虽无真正意识却可能让人误以为有,会带来社交、道德和法律影响,他还给出应对方案。

机器之心
新闻资讯7

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

奥特曼首晒GPT - 5实测,虽对话仅围绕电视剧推荐,但引发大量关注。除官方放料,还被曝重写编码规则,用上超级对齐团队“遗产”通用验证,不过也有爆料称其研发遇困难。

量子位