「模型G0.5」共找到 9005 篇相关文章

算法论文8

ICCV 2025|UV-CoT:无监督视觉推理新突破,偏好优化重塑图像级思维链

随着文本领域思维链推理机制成功应用,研究者将其引入视觉理解任务。现有模型有局限,本文提出UV - CoT新框架,设计无监督数据生成与偏好优化机制,提升模型能力,摆脱对人工标注依赖。

机器之心
算法论文8

港科大&北京人形提出LOVON:足式机器人开放世界全域目标追踪新范式!

港科大广州联合北京人形创新中心推出LOVON框架,融合大语言模型、开放词汇视觉检测和语言 - 运动映射模型,解决足式机器人开放世界全域目标追踪难题,有抗干扰视觉处理等优势,性能超传统方法。

机器之心
推荐文章7

「Tokens是胡扯」,Mamba作者抛出颠覆性观点,揭露Transformer深层缺陷

Mamba作者Albert Gu在博客中探讨状态空间模型(SSM)和Transformer权衡,抛出‘Tokens是胡扯’观点,揭露Transformer深层缺陷,如分词问题、处理噪声能力弱等,还分析两类模型特点及结合优势。

机器之心
推荐文章7

YC最新总结顶尖的提示词应该怎么写?

提示工程在大模型时代愈发重要,其核心在于提示词设计。近日,YC在播客分享从与大模型创业公司学到的提示工程实践,涵盖核心原则、进阶技巧、企业级实践、创业者模式等内容。

AI工程化
开源动态8

StarRocks MCP Server 开源发布:为 AI 应用提供强大分析中枢

过去,开发者让大模型用数据库查询数据需开发插件等,费时费力且难复用。StarRocks MCP Server 提供通用接口,让 LLM 标准化访问 StarRocks,执行 SQL 查询。MCP 规范模型与上下文交互,其核心组件分工明确。

开源AI项目落地
开源动态8

浙大开源PhyEdit:单图编辑+精准3D物体操作 | ACM MM'26

浙江大学ReLER团队开源的PhyEdit,用3D foundation model明确目标几何,让DiT图像编辑器负责最终渲染。单张图片里物体能移动并形成连续状态,在多项指标表现出色,还具备多种能力,已被ACM MM 2026接收。

新智元
新闻资讯7

8个AI顶流科学家,300亿估值:他们要让AI自我进化

AI初创公司Recursive结束隐身状态,公布八位联合创始人名单,完成6.5亿美元A轮融资,估值达46.5亿美元。公司旨在推动自我改进型人工智能发展,让AI学会科研,虽面临挑战,但受算力产业链关注。

DeepTech深科技
开源动态8

一张4090就能爆改!面壁智能MiniCPM-V 4.6开源,1B多模态卷出新高度

今年是AI应用大规模落地年,参数小的端侧模型有特定场景性能优势。5月11日面壁智能开源MiniCPM-V 4.6,参数仅约1B,多模态能力超阿里、谷歌同类模型,还在多维度提升,站稳端侧多模态开源领域。

机器之心
新闻资讯7

阿里云飞天企业版X平头哥“真武”芯片,推理性能跃迁13倍,底层逻辑是什么?| Q推荐

过去几年,模型虽强但使用成本高,阻碍企业级AI深度应用。今年‘模型推理’成AI关键词,4月13日19:00,InfoQ联合阿里云邀专家围绕推理加速底层破局展开对话,探讨算力博弈、芯片性能跃迁等问题。

InfoQ
算法论文7

高效Agents的尽头是,Harness

文章指出玩Agent久了会出现问题,很多人简单将其视为“模型+工具”组合远远不够。以OpenDev为例,介绍了Harness架构,包括核心理念、扩展ReAct循环、上下文工程等,还提及安全架构、多模型路由等内容。

PaperAgent