专家级表现」共找到 3389 篇相关文章

开源动态8

超越纯视觉模型!不改VLM标准架构,实现像素深度预测

Meta开源DepthLM,首证视觉语言模型不改架构就能媲美纯视觉模型的3D理解能力。通过视觉提示等创新策略,它精准完成像素深度估计等任务,为多领域带来前景。

新智元
新闻资讯7

全国首部“数据流通交易合规”标准,现公开征集起草单位和专家

2026年是数据要素价值释放年,数据资产交易却面临合规与安全难题。中国电子商会归口、智合标准中心组织编制《企业数据要素流通交易合规指南》团体标准,涵盖多核心模块,有三大亮点,现征集起草单位和专家

AI工程化
开源动态8

腾讯开源最强3D生成模型,消费显卡就能跑 | CVPR

在CVPR上,腾讯混元3D 2.1模型宣布开源。相比前一代,它实现几何与纹理双重优化,纹理贴面提升大,达当前开源3D模型SOTA水平。全链路开源,适配消费显卡,Hugging Face下载量超180万。

量子位
新闻资讯7

陶哲轩亲测Claude跑崩电脑,全靠这份保姆指令清单翻盘

全球顶尖数学家陶哲轩实测Claude Code,首次完全放权致电脑崩溃。后拆分任务、给出「保姆」指令,约半小时完成证明。他强调人类应保持「人类在环」,拒绝过度依赖AI。

新智元
新闻资讯8

a16z 发布百大【生成式AI】消费应用排行榜第五版

a16z发布第五版百大生成式AI消费应用榜单,揭示普通人使用AI习惯的演变,生态趋于稳定。谷歌多款产品上榜,Grok与Meta加入战局,中国本土赢家崛起,“凭感觉编程”催生真实用户,还公布“全明星”阵容。

宝玉AI
产品应用8

谷歌做了个论文专用版nano banana!顶会Figure直出

科研人画论文插图耗时久、要求高,现有大模型搞不定。北大与Google Cloud AI Research团队推出PaperBanana,能按论文方法画顶会Figure,不仅能从零生成,还能润色丑图,通过多智能体协作实现科研表达自动规范化。

机器之心
算法论文8

一键开关灯!谷歌用扩散模型,将电影光影控制玩到极致

Google推出LightLab项目,可从单张图像精准控制光影,解决传统光影控制难题。其通过特殊数据集微调扩散模型,让模型学会控制光照,还介绍了方法、后处理流程等,实验显示表现优,有多种应用。

机器之心
产品应用8

百度文库网盘发布 GenFlow2.0,支持同时调用超 100 个专家智能体

8月18日,百度文库联合百度网盘发布全球首个全端通用智能体「GenFlow2.0」。它支持超100个专家智能体并行工作,解决描述难、等待久等问题,还打通百度生态资源,兼容MCP协议,接入荣耀智能助理。

InfoQ
新闻资讯7

谷歌Gemini一次提示能耗≈看9秒电视,专家:别太信,有误导性

谷歌报告称处理一个中位数的Gemini文本提示能耗低,2024 - 2025年单个文本提示能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑其方法论,指出未算间接用水、碳排放核算不全等问题。

机器之心
开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心