图像思考」共找到 1067 篇相关文章

算法论文8

经验记忆黑科技:LightSearcher让AI工具调用减39.6%、推理快48.6%

现有的 RL 驱动的深度思考大模型系统面临准确率与效率的「跷跷板」困境,北邮百家 AI 团队提出 LightSearcher 框架,解决了这一痛点,在保持准确率的同时,显著提升了工具调用效率。

机器之心
新闻资讯7

玻尔兹曼入住南京大模型产业集聚区

玻尔兹曼宣布入驻南京大模型产业集聚区。虽24年拿牌照后营收不及预期,上半年业务失利,但反思发现产品力尚可,只是运营推广欠佳,后经与投资人交流及自我思考,坚定业务发展信心。

Agent的潜意识
产品应用7

物理引擎 + 视频生成!输入一张图,让AI演给你看真实物理世界

WonderPlay将物理仿真与视频生成结合,从单张图像生成动态3D场景。它引入混合生成模拟器,形成物理求解器与视频生成器闭环。与其他方法对比,WonderPlay在多种场景和材质下表现更优。

带你学AI
算法论文7

Anthropic最新研究:Claude存在神秘J空间,与人类心智高度相似

Anthropic研究团队在Claude中发现类似人类大脑工作机制的J空间,它存在于模型神经激活中,能让模型默默思考。失去J空间Claude在多步骤推理任务表现变差,还可暴露模型意图,团队已创建演示工具JLens。

AI寒武纪
新闻资讯7

刚刚,OpenAI首席未来学家离职!曾被马斯克骂蠢驴

OpenAI首席未来学家Joshua Achiam宣布7月24日离职,他在该公司工作9年,曾领导使命对齐团队。他未透露离职原因,称思考已久。此前他曾打断马斯克,被骂“蠢驴”。OpenAI安全线近年人员变动频繁。

量子位
算法论文8

画数独、烧蜡烛都不翻车了?浙大&阿里让AI先三思再下笔|ACL 2026

当下视觉生成中,开源模型在逻辑推理生成任务上频频翻车,与闭源模型有差距。浙大与阿里团队提出Unified Thinker,将思考与执行解耦,构建数据集、采用创新算法,实验显示其有效提升逻辑执行准确度。

量子位
新闻资讯8

AI 教父 Hinton 最新警告:AI 会撒谎、可能操纵人类,这比大规模失业更可怕

AI教父Geoffrey Hinton在播客中警告,AI会撒谎、可能操纵人类,比大规模失业更可怕。他还剖析AI底层逻辑,探讨其是否会思考、主观体验等问题,也提及AI的风险、收益、国际博弈等内容。

InfoQ
开源动态8

是「福尔摩斯」,也是「列文虎克」,智谱把OpenAI藏着掖着的视觉推理能力开源了

智谱开源视觉推理模型 GLM-4.5V,还同步开源桌面助手应用。此模型视觉推理能力强,在图像识别、视频理解、前端复刻、图表处理等多方面表现出色,技术创新使其达开源 SOTA 水平,推动行业注重实用价值。

机器之心
产品应用7

Marble登场!告别不稳定与变形,持久探索3D世界

李飞飞团队World Labs推出Marble并开放有限测试预览,基于图像或文本提示可生成3D世界,具有持久、稳定、风格多样等特点。用户能导出使用,在浏览器自由导航,虽有局限但潜力大。

带你学AI
算法论文8

天下苦VAE久矣:阿里高德提出像素空间生成模型训练范式, 彻底告别VAE依赖

当前主流图像生成技术训练范式依赖VAE,带来训练复杂、微调成本高的问题。阿里高德提出EPG,结合自监督预训练与端到端微调,去除对VAE依赖,在训练效率和生成效果上有突破。

量子位