「图像图形技术」共找到 3234 篇相关文章
一个问题几百美元,DeepMind智能体一次搞定了9个Erdős问题
DeepMind团队的大模型在一次‘测试’中解决9个开放的Erdős问题,还自动验证,解法通过人工审查。其框架AlphaProof Nexus结合大模型与Lean编译器,研究展示了AI辅助正式证明搜索技术潜力。
2026论文解读,ASAHI:自适应切片助力小目标检测,速度提升25%、精度创新高
高分辨率航空图像小目标检测难,传统检测器表现差。2026年4月都灵理工大学团队提出ASAHI,用自适应切片框架,在VisDrone2019上mAP50达56.8%,推理速度比SAHI提升20 - 25%,还介绍了实战代码等。
深度|Karpathy为何突然加入Anthropic,只能当Dario的「-2」?
5月19日,OpenAI联合创始人Andrej Karpathy宣布加入Anthropic预训练团队。他将组建新团队,用Claude加速预训练研究。文章分析了他加入的原因,以及Anthropic招聘他的动机,还指出这一变动标记着技术拐点。
硅谷知名投资人Jaya Gupta:AI公司真正的护城河,是组织本身
硅谷知名投资人Jaya Gupta认为,AI时代竞争从技术层坍缩到组织层,公司真正的护城河是底层的「机构」,人就是公司本身。伟大的公司为特定人才提供表达自我的结构,在身份认同等方面竞争。
独家丨欧拉万象完成数亿元融资,要做「养成系」家庭具身智能机器人
AI科技评论独家消息,家庭具身智能企业欧拉万象近日完成数亿元融资,由招商局创投领投。其创始人团队背景强大,走‘渐进式进化’技术路线,将推可养成机器人,策略务实获资本认可。
DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude
DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。
完全运行在浏览器中的全功能 3D 建筑编辑器无需 AutoCAD\Revit,也无需每年 5,000 美元的授权费用,100%开源免费
Pascal Editor是完全在浏览器运行的3D建筑编辑器,开源免费,无需AutoCAD、Revit及高额授权费。它采用节点式场景结构,有多种特性,技术栈丰富,分层设计让核心逻辑可复用,性能优化亮点多。
我嘞个豆!中国企业牵头,ICLR这场Workshop被挤爆了
ICLR 2026在巴西线下举办,华人活跃其中。一场由阿里妈妈牵头的Workshop被围得水泄不通,聚焦机制设计与决策智能,这是ICLR历史上首个该方向Workshop,集结了顶尖高校,探讨AI重写下的相关问题。
国产多模态Agent拿下医学分割SOTA!不用改模型、不加token | 浙大&上海AI Lab
现有医学多模态大模型在分割生物医学图像时存在瓶颈,浙大蔡钰祥教授、上海AI Lab江彦开等人提出IBISAgent框架,将分割定义为多步视觉决策过程,实验显示其在多数据集上大幅领先对比方法。
「部署态」元年,这家公司就把落地方案卷到了七种
在4月17日上海举办的大会上,智元拿出四大全新机器人产品、六大AI模型、七大标准化生产力解决方案及全栈生态技术体系。其创始人认为具身智能正从“开发态”向“部署态”进化,2026年是元年。