多工具推理」共找到 6877 篇相关文章

新闻资讯7

Gemini 3.5 Pro绝密泄露,前端赶超Fable 5!

全网被Gemini 3.5 Pro泄露刷屏,传闻7月17日发布。它在前端生成表现出色,一次成型、精准零失误,性能超Fable 5,但在硬核推理等任务上不如Fable 5和GPT - 5.6。谷歌为其重预训练,还准备对标GPT - Image 2的图像模型。

新智元
产品应用8

Luma Uni-1.1 API开放,图像模型榜单第三,文字渲染直逼GPT image 2

今年图像生成模型迭代快,海外AI初创公司Luma将统一图像模型Uni - 1升级到1.1版并开放API。它在榜单排名前三,价格与延迟低,有诸品牌客户接入。展示了场景应用效果,技术路线独特,定价有优势。

机器之心
新闻资讯7

李飞飞引爆的3D新技术,为什么这家深圳公司两年前就“玩腻”了?

李飞飞宣布可在任意设备流式传输超1亿个高斯泼溅,引发对3DGS的关注。其实深圳其域创新两年前就推出相关产品并开源。3DGS面临传输、加载和生态问题,现正从展示介质变为生产力工具,其域方案成底层支撑。

量子位
新闻资讯7

全球看中国,灵初智能用10万小时人类数据写下具身智能的中国答案

2026年,“世界模型”成具身智能高频词。灵初智能联合创始人陈源培认为其非核心方向,而是数据迁移工具。灵初关注人类操作数据转化,在10万小时量级上可大幅替代真机数据,还介绍了系统模块、数据集及商业化阶段等情况。

机器之心
开源动态8

中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强图文跨模态模型

360推出FG-CLIP2图文跨模态VLM模型,在八大类任务、29项测试中超越Google与Meta。它能像素级看图,中英文皆强且已开源。其优势源于高质量数据集和先进训练方法,还在业务落地并开放API。

机器之心
开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,平台支持。

量子位
新闻资讯8

在「外滩大会·具身智能:从泛化到行动,重塑产业未来」上,这些大牛都说了什么?

9月11日,机器之心联合出品的外滩大会见解论坛聚焦具身智能。位学界和业界代表分享看法,如孙富春称训练场可破数据瓶颈,江磊指其是新型数据工厂。思辨和圆桌环节探讨技术路线、应用场景等关键问题。

机器之心
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在大模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
新闻资讯7

智能体崛起,AI+软件研发到新拐点了?

InfoQ《极客有约》X AICon 直播探讨 LLM 时代软件研发新范式。嘉宾认为 AI 在研发中是提效工具,距原生开发尚远;部分开发环节已由 AI 接手,落地面临稳定性等问题;未来智能体协作是趋势,部分工程师价值将放大。

InfoQ
新闻资讯7

Claude最强领域被GPT反超!GPT 5.5最难编程基准破0

编程领域曾由Claude引领,如今GPT 5.5在大模型解决率为0%的最难编程基准上实现突破。程序重建基准测试(ProgramBench)考验严苛,过往模型解决率为0,GPT 5.5高和超高推理模式成功破局,展现了不同解题风格。

AIGC开放社区