3D动画生成」共找到 3888 篇相关文章

算法论文8

爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了

最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。

新智元
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
算法论文8

CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」

新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。

新智元
新闻资讯7

OpenAI:GPT-5就是All in One,集成各种产品

OpenAI研究副总裁剧透GPT - 5将整合Codex、Operator等产品。团队分享Codex详情与未来计划,回应10大问题,如语言选择、运行方式等,还将推免费API积分,发布了Codex上手指南。

量子位
新闻资讯7

谷歌发76页智能体白皮书!你的「AI替身」已上线

谷歌发布76页AI智能体白皮书,剖析其应用前景。涵盖智能体运维、评估方法,探讨多智能体架构,还介绍智能体增强检索生成及企业应用,如NotebookLM企业版、Agentspace空间企业版等。

新智元
算法论文8

AgentA/B:用AI模拟用户,真人AB测试或将成为历史

宾夕法尼亚州立大学和亚马逊合作研发AgentA/B测试框架,用大语言模型生成虚拟用户模拟真实行为,成本低、速度快,还能绕开真实流量测试。虽有人质疑,但它或改变传统AB测试。

AGI Hunt
产品应用7

Claude有「编制」了!Anthropic发的

6月23日,Anthropic发布Claude Tag,它是常驻Slack频道的AI团队成员,有自己的身份、账号和审计轨迹。其核心是权限架构,采用智能体身份,按用量计费,已对企业版和团队版客户开放beta。

新智元
新闻资讯7

Cloudflare 构建了面向 LLM 的高性能基础设施

Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。

InfoQ
新闻资讯8

刚刚,ChatGPT免费模型升级了:幻觉砍半/记忆更强/回答更简洁

ChatGPT默认模型升级为GPT - 5.5 Instant,免费用户可用。它幻觉减少52.5%,新增“记忆来源”,答案更简洁,语气更温暖自然。从5月5日起向所有用户滚动上线,替代GPT - 5.3 Instant。

量子位
新闻资讯8

AI能改10万行代码,却让你走路去洗车!Karpathy戳破「锯齿状智能」

Karpathy在Sequoia AI Ascent 2026炉边谈话指出,AI能力呈锯齿状,背后是经济学问题。他还提及软件新地平线,认为Vibe Coding抬高编程地板,专业开发需智能体工程,人类在智能体时代是工程导演。

新智元