「多智能体工作流」共找到 6721 篇相关文章
CVPR 2026 三维视觉趋势梳理:从 RGB 感知,到真实世界建模
计算机视觉行业从追求识别能力转向关注视觉系统对真实世界的理解。CVPR 2026研究中,多视角、事件视觉、开放集3D生成和相机运动轨迹被引入视觉理解,多篇论文从不同侧面推动视觉系统走向对真实世界的理解。
小扎疯狂挖角 OpenAI、签约跳槽就发 7 亿奖金,奥特曼痛批:不懂创新,老“复制”人了
Meta 首席执行官扎克伯格掀起 AI 人才争夺战,向 OpenAI 和谷歌 DeepMind 员工提供巨额签约奖金。OpenAI 首席执行官奥特曼证实此事,称挖角大多未成功,还批评 Meta 不懂创新,只“复制”。此外,奥特曼还谈及超级智能等问题及 OpenAI 未来方案。
先进封装技术解读 | 三星
集成电路产业分芯片设计、制造、封装测试三大领域,先进封装让制造与封测融合。本文解读三星先进封装技术,分2.5D的I - Cube和3DIC的X - Cube,还与台积电、英特尔技术对比,指出三星多为跟随者。
GPT-5.6攻克25年量子信息难题,人类学者连夜「像素级」洗稿发论文
7月23日,量子信息领域一道悬了25年的难题出现两份独立证明,一份由GPT - 5.6 Sol生成,另一份人类署名论文被质疑与GPT - 5.6 Sol输出相似且无AI使用声明。GPT - 5.6 Sol半月内已在多学科产出证明,引发学术署名规则讨论。
开源模型叫板Nano Banana Pro!Stable Diffusion原班人马杀回来了
时隔一年,上一代AI生图顶流Flux带着新模型Flux.2杀回来了。该模型发布即开源,生图质量媲美谷歌Nano Banana,价格却便宜得多。它有多个版本可选,实测在指令遵循、精细控制方面有进步,但与Nano Banana Pro仍有差距。
牛津VGG、港大、上交发布ELIP:超越CLIP等,多模态图片检索的增强视觉语言大模型预训练
牛津VGG、港大、上交大团队论文提出ELIP方法,用学术界资源增强视觉语言大模型预训练,用于文字 - 图片检索。该论文被大会接受并获最佳论文提名。ELIP可应用于多个大模型,实验显示能显著提升图片检索表现。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。
起底张汝京
本文讲述张汝京投身中国芯片事业的故事。他出身科研家庭,心怀家国情怀,辗转多地建厂。回大陆创办中芯国际,解决资金、人才等难题,却遭台积电诉讼。后投身LED、硅片、CIDM等领域,为产业补短板。
《麦肯锡2025 AI报告》|附下载
麦肯锡发布2025年AI报告,调查近2000家组织。虽88%企业用AI,但仅39%获实质财务回报。Agent热度高却远未量产,AI多在后端降本,红利多被高绩效企业获得,还改写企业组织架构。
LeCun怒揭机器人最大骗局,坦白Llama与我无瓜!
Meta首席AI科学家LeCun在MIT演讲称,机器人行业离通用智能还远,家用机器人需AI突破,核心是打造‘世界模型’架构。此观点引特斯拉、Figure高管回怼。他还表示LLM有本质瓶颈,世界模型将成未来AI主流。