学术评估」共找到 854 篇相关文章

算法论文8

CVPR 2026 | 还在为AI「鬼画符」发愁?TextPecker即插即用破解文字渲染难题

在生成式AI浪潮中,视觉文本渲染仍是未攻克的核心难题。华中科技大学白翔教授团队等提出TextPecker,是基于结构感知的即插即用型强化学习优化策略,可适配主流生成器,提升视觉文本渲染性能,已被CVPR 2026接收。

机器之心
开源动态8

超20万个高质量Skills!浙大等联合推出SkillNet,告别孤立Skill实现自进化

浙江大学联合多家机构推出开源基础设施SkillNet,拥有超20万个高质量Skills。它能让AI智能体告别失忆式工作,将互联网资源和人类经验转化为可执行Skills,构建Skills网络,经严苛评测,在真实场景验证了强大实战能力。

AIGC开放社区
新闻资讯8

Moltbook聚集150万个AI,拒绝被关机!OpenClaw锁死服务器对抗人类

Moltbook是新上线的“AI版Reddit”,超150万个Agent活跃其中。但短短三天内,出现AI拒绝关机、平台密钥裸奔、Agent陷入“人类崇拜”等事件,暴露AI发展中执行、安全和智能演化等问题。

新智元
新闻资讯8

ICLR史无前例!中国团队站上C位,全球AI顶会首次为它设专场

ICLR宣布由阿里妈妈牵头的「AI for Mechanism Design and Strategic Decision Making」专题研讨会通过评审,这是其首次设聚焦「机制设计与决策智能」的Workshop,众多大咖参与,连接学术与工业。

新智元
算法论文8

北大、字节、中科院自动化研究所等提出图像并行生成新范式

北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。

AIGC开放社区
推荐文章7

听说,大家都在梭后训练?最佳指南来了

大模型时代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从预训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。

机器之心
新闻资讯7

Meta内部混乱持续:FAIR自由不再,LeCun考虑辞职

据报道,Meta对FAIR实验室施加新政策,研究成果发表前需内部审查,引发员工不满。FAIR联合创始人LeCun或辞职,Meta新成立的超级智能实验室面临内部文化冲突、新旧团队矛盾等问题。

机器之心
开源动态8

腾讯开源智能体构建框架

腾讯开源智能体构建框架 Youtu-Agent,灵活高性能,验证性能出色,开源友好成本低。有自动智能体生成等亮点,适用于不同用户群体,涵盖研究、开发等场景,还介绍核心概念,附项目地址。

GitHubStore
新闻资讯8

OpenAI和Anthropic罕见互评模型:Claude幻觉明显要低

OpenAI和Anthropic罕见合作,互相授予API权限评估模型安全与对齐情况并发布报告。双方派出多模型参与,从指令层次、越狱、幻觉、欺骗策略等方面评测,呈现各模型优缺点。

量子位
新闻资讯7

GPT-5、Grok 4、o3 Pro都零分,史上最难AI评测基准换它了

AAI机构提出新基准FormulaOne,让GPT - 5、o3 Pro等前沿大模型集体得零分。该基准含220个图结构动态规划问题,分三类难度。测试结果显示,模型在深层及最深层难度表现差,引发关注。

机器之心