评估问题」共找到 3773 篇相关文章

算法论文8

谷歌发布智能体Scaling Law:180组实验打破传统炼金术

谷歌新论文通过180组实验找到智能体的Scaling Law(定量扩展原则),在四个基准测试评估,推导预测模型,实验结果颠覆直觉,还量化阻碍因素,发现不同模型协作性格,为智能体部署决策提供支撑。

机器之心
新闻资讯7

英伟达亲手终结CUDA「护城河」?传奇芯片架构师引发争议

英伟达CUDA宣布20年来最重大更新,引入CUDA Tile技术,降低开发门槛。芯片界传奇人物Jim Keller质疑此次更新是否终结CUDA「护城河」,文章分析了相关问题,指出瓦片架构对英伟达内外移植性的不同影响。

新智元
新闻资讯7

豆包手机底层系统被曝是锤子 SmartisanOS!官方深夜回应微信登录异常等

近日,豆包手机助手发售被抢购一空。随后有博主发现其底层系统疑似锤子 SmartisanOS。此外,该助手还出现微信登录异常、被指侵犯隐私等问题,官方深夜回应称是技术预览版,面向特定人群,会保障隐私。

InfoQ
开源动态8

告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质

南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题

AIGC开放社区
新闻资讯7

兵临OpenAI!谷歌集结2500人「复仇」,Gemini 3夺回AI王座

谷歌发布Gemini 3欲夺回AI主导权。谷歌DeepMind的CTO与AI Studio产品负责人剖析其发布盛况等,称这是与全球用户共建AGI的实验,还谈到模型发展、应用及多模态等问题,也承认仍有提升空间。

新智元
产品应用7

谷歌Agent正在憋大招:AI科学家内测,锦标赛制“炼”想法,一次跑40分钟

谷歌正为Gemini Enterprise开发多智能体系统,能扮演联席科学家提炼想法,实现研究自动化。工作时以锦标赛形式评估想法,一次运行约40分钟,还准备了“想法生成”“联席科学家”等智能体。此外还有“与文档对话”功能。

AI寒武纪
产品应用8

终于,TRAE SOLO全量开放,我们用它复刻了PewDiePie的大模型智囊团

2025年AI Coding赛道上,TRAE是国产AI IDE代表作。7月其SOLO Beta版反响好,如今正式版全量推送。它定位为‘具备响应感知的编程智能体’,新增功能,还限时免费体验,实测显示开发能力强。

机器之心
产品应用8

获NVIDIA致谢:悟空Agent的实践、复盘与迭代

本文以悟空Agent获NVIDIA致谢为切入点,介绍多智能体架构闭环及实战挑战,如上下文断流、调度失衡。还阐述架构设计、迭代优化、数据飞轮体系,指出AI infra存在安全隐患,强调安全融入业务的重要性。

腾讯技术工程
开源动态8

长达790年视频镜头,打造原生多模态世界模型!北京智源研究院用Emu3.5统一“世界”

北京智源研究院发布并开源基于原生多模态训练的世界学习者Emu3.5,它将视觉和语言视为同一种数据流,在超13万亿token数据上学习,解决长视野多模态信息处理问题,经多阶段训练和优化,能力强大且已开源。

AIGC开放社区
新闻资讯8

分析1.8亿份招聘数据后,他告诉你AI究竟取代了哪些工作

本文分析1.8亿份全球招聘信息,发现AI不是造成大规模失业主因,影响因岗位而异。创意执行类岗位下降多,AI基建岗位增长,程序员、客服、销售较稳定,高层受冲击小,还给出评估岗位安全的建议。

花叔