「VAE-LLM数据增强」共找到 3318 篇相关文章
Manus高溢价收购背后,是Agent开发落地困境
近期Meta 20亿美元收购Manus引发关注,暴露Agent开发落地难题。阿里云百炼升级“1+2+N”体系,“N”组件解决数据、安全等问题,“2”提供新开发范式,“1”深挖模型服务工程,还发布企业版助力落地。
网民票选AI王者,LMArena一夜变17亿美元独角兽!
LMArena原是校园开源小项目,从2023年起步,如今估值达17亿美元。其Arena模式让网友盲投选AI,Elo评分系统算排名。虽有众包投票易操纵等争议,但已成行业标杆,还将为大厂提供付费评估服务。
老黄All in物理AI!最新GPU性能5倍提升,还砸掉了智驾门槛
英伟达CEO黄仁勋在CES 2026发布AI新品,全力搞AI。推出下一代Rubin架构GPU,性能大幅提升;发布五大领域成果,含新模型家族、平台等;还开源训练框架与多模态数据集,国产开源模型被提及。
近期,谷歌发了两篇Agent Scaling论文,有点东西
2025年LLM社区有Test - Time Scaling和Agent化两条主线,但‘更多agent是否更好’无人能定量回答。谷歌两篇论文将agent scaling拆成可预测、可度量的科学问题,涉及预算感知和多agent盈亏平衡点。
以孔子命名,超越Claude 4.5 Opus,Meta发布工业级自我进化AI软件工程师CCA
Meta与哈佛联合推出工业级软件工程师CCA,它是一套让AI在工业级代码库协作的方法论,解决长上下文推理等难题。其三维解耦设计、精细记忆机制、自我进化能力获数据验证,还适合引入强化学习。
斯坦福人均≈0.1张GPU!学术界算力遭「屠杀」,LeCun急了
学术界GPU荒严重,美国顶尖大学人均GPU少,与大厂差距大。如斯坦福人均0.14张,而微软等大厂数据中心算力惊人。这导致人才流向工业界,学术验证能力弱,但部分高校有改善措施。
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。
AI工具已成为史上最大流量入口?
作者白杨SEO看到一张称主流AI工具成史上最大流量入口的图,提出质疑。他指出数据存疑,AI用户使用量远不及搜索,商业化也不成熟,还对比国内外AI搜索优化GEO差异,认为企业要提前布局。
Agentic 应用时代,Dify 全链路可观测最佳实践
文章讲述 Dify 平台在 Agentic 应用开发的可观测性挑战,从开发者与运维方视角分析现状、局限与改进方向。云监控推出全景可观测方案,还介绍各组件监控接入步骤及实践指南,最后提及 Qwen - Image 生图优势。