生成质量」共找到 2610 篇相关文章

开源动态8

腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent

智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。

量子位
新闻资讯7

Claude翻车:Opus 4.1白天退化,Anthropic承认并回滚更新

发布即拿下各项SOTA的Claude Opus 4.1翻车,用户反馈其变得迟钝,官方承认处理某些请求时质量退化,如白天推理性能下降,使用限制不明确,还会暴露API密钥,官方已回滚版本。

量子位
产品应用8

AI智能体加持,爆款视频产出速度提升了10倍,全民导演时代已来

Video Ocean在影像创作领域带来革新,通过AI Agent实现一人完成多职能,将拍摄周期大幅缩短。它打造自动化创作生态,能快速批量生成爆款视频,覆盖多种创作场景,操作简单,打破创作壁垒。

机器之心
新闻资讯7

“现在读AI博士已经太晚了”

谷歌生成式AI团队创始成员Jad Tarifi劝退AI博士,称等毕业AI或被解决。当下科技巨头天价抢人才,AI也成裁员推手,应届毕业生就业难。他建议发展社交技能和同理心应对。

量子位
算法论文8

工具增强的多模态LLM综述

多模态大语言模型(如GPT - 4V)虽有强大图文理解能力,但受数据稀缺、复杂任务表现不佳和评估标准不统一限制。论文提出为MLLM集成外部工具,构建全景图,覆盖多维度,还指出挑战与对策。

深度学习自然语言处理
开源动态8

国产LLM大爆发的一周,Hugging Face热榜被承包了!

这一周国产开源LLM集中爆发,GLM - 4.5、Qwen3的5连发、Step3等接连发布。GLM - 4.5是新一代开源SOTA模型;Qwen3各版本在不同能力上提升显著;Step3是多模态推理模型;腾讯还发布了混元3D世界模型1.0。

PaperAgent
算法论文8

ScreenCoder:视觉-代码对齐新范式,为多模态程序合成开辟道路

前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化多智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为多模态程序合成开辟道路。

深度学习自然语言处理
算法论文8

研究者尝试揭示扩散模型创造力的起源

斯坦福大学研究人员 Mason Kamb 与 Surya Ganguli 在论文中提出解释扩散模型创造力的机制,指出其创造力是去噪生成图像时的确定性结果,还识别出关键偏置,搭建 ELS 机模型并验证其准确性。

InfoQ
算法论文8

AI"学霸"也解不出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板

耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。它有高质量数据、多模态多题型测试和精细知识分类体系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。

深度学习自然语言处理
算法论文8

AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT

斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。

量子位