对比实测」共找到 898 篇相关文章

产品应用8

前端同事看走眼了,这个“游戏网页”其实全是AI写的!

Kimi K2.5上新,集视觉理解、代码生成等能力于一体,提供四种使用模式,其中Agent集群模式提效显著。实测显示其网页生成、动效理解能力出色,下一代K3模型或用新架构KDA降低计算成本。

InfoQ
开源动态8

自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源

大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。

机器之心
新闻资讯7

跑分第一,实战拉胯!GPT Image 1.5被骂惨,奥特曼这波悬了

OpenAI推出新一代旗舰图像模型GPT Image 1.5,生图能力强,免费用户可上手,开发者能调用API。它在跑分榜单成绩优异,但网友实测发现是‘高分低能’,引发吐槽。此外,其API价格降20%,此次更新是回击谷歌。

新智元
开源动态7

美团也开源了大模型,但我觉得他们的野心是通用生活Agent。

美团发布并开源560B参数的MoE模型LongCat - Flash - Chat,推理速度快。与DeepSeek V3对比,输出速度优势明显。美团多个落地或内测AI功能服务C端生活场景,目标是打造通用生活Agent。

数字生命卡兹克
算法论文8

《TAML》好文推荐 | 来自清华大学张宇飞团队最新研究成果 基于文本生成翼型:FoilCLIP,一种语言驱动的气动设计新框架

传统翼型设计依赖CFD和风洞试验,成本高。清华大学张宇飞团队提出端到端双向映射框架FoilCLIP,通过对比学习建立文本与翼型几何双向映射,还提出数据增强策略,验证了其在语言驱动设计中的应用潜力。

力学与人工智能
新闻资讯7

给龙虾定MBTI、发工牌,还让龙虾偷技能…打工人得适应新环境了

AI圈掀起“养龙虾”热潮,智谱、腾讯纷纷发布相关产品。极客和开发者对龙虾进行实测,它不仅能用于打造赛博宠物、线上办公室,还能完成视频剪辑、教辅、营销等工作。同时,Agent框架让大模型进入业务线,飞书成合适的工作台。

量子位
产品应用8

那个用半成品刷爆SOTA的Qwen3超大杯推理版,现在正式上线

阿里千问率先发布Qwen3-Max-Thinking正式版,刷新全球SOTA。该模型总参数超万亿,有技术创新,提升了推理性能和原生Agent能力。实测代码和工具调用能力强,还透露技术细节,中国开源模型影响力不断提升。

量子位
开源动态8

谷歌最强AI,被港科大开源超了?让海外创作者喊出「King Bomb」的P图大杀器来了

图像编辑与生成模型爆发,冲击Photoshop地位。港科大贾佳亚团队开源DreamOmni2,优化升级多模态指令编辑与生成能力,效果获海外创作者认可,还在实测中表现出色,其采用创新技术方案构建多模态生成体系。

机器之心
算法论文9

让具身智能体拥有「空间感」!清华、北航联合提出类脑空间认知框架,导航、推理、做早餐样样精通

清华、北航联合提出类脑空间认知框架 BSC-Nav,让具身智能体有「空间感」。它克服现有导航方法记忆难题,有三大记忆组件,实验中性能碾压,能应对复杂任务,真机实测也表现出色。

机器之心
新闻资讯8

刚刚,Fable-5之下,智谱开源的GLM-5.2拿下AI编程第一!

智谱开源的GLM - 5.2在AI编程领域成绩斐然,在Arena获全球第二、Design Arena全球第一,八项基准测试表现亮眼。经多方面实测,它在长程任务中优势明显,标志国产开源模型进入开发者工作流和硬核工程阶段。

量子位