大模型测试」共找到 9649 篇相关文章

产品应用7

豆包模型2.0+Claude Skills,3步装好,终于有AI能帮我"看视频做笔记"了!火山引擎全系列可用!

传统视频总结工具只基于音频总结,内容浅显。而豆包模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“看”视频,输出详细笔记。

AI产品自由
开源动态8

× MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings

开放世界机器人操作被模型算力成本和推理延迟难题困住,中与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。

AI科技评论
推荐文章8

超实用提示词模板!AI科学家教你用协作提示词激发模型潜力

文章由知名AI科学家Lance Eliot所写,指出主流语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。

AIGC开放社区
开源动态7

DeepSeek R1/V3作者开源轻量级vLLM,1200行代码读懂模型推理技术!

DeepSeek R1/V3作者俞星凯开源轻量级vLLM——Nano - vLLM。它有快速离线推理、代码可读、含优化套件等特性,还给出了RTX 4070等硬件和Qwen3 - 0.6B模型的基准测试配置。

PaperAgent
开源动态8

10% KV Cache实现无损数学推理!这个开源方法解决推理模型「记忆过载」难题

推理模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。

量子位
产品应用8

比英伟达早,比李飞飞强,晓Kairos原生一体化世界模型定义物理AI新路线

晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四权威具身智能基准上全面登顶。

机器之心
新闻资讯7

刚刚,全球最难考试惊天反转!黑马AI冲破36%,顶流模型集体翻车

ARC-AGI-3测试中,顶级模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
算法论文8

AAAI 2026 Oral | 拒绝「一刀切」!AdaMCoT:让模型学会「看题下菜碟」,动态选择最佳思考语言

多语言模型面临语言选择难题,现有跨语言推理方法存在缺陷。新加坡研究团队推出AdaMCoT框架,通过自适应路由机制动态选语言推理,提升跨语言事实推理准确性与一致性,效果超越传统方法。

机器之心
新闻资讯7

刚刚,智谱正式成“全球模型第一股”,开盘涨超3%!10位董事7个清华背景,专家:国内IPO抢收“确定性”,OpenAI们豪赌“无限性”

今日,智谱在港交所挂牌上市,成“全球模型第一股”。其有技术、产品、商业化优势,但未盈利,研发投入高。专家认为其上市早,国内厂商上市为求确定,而OpenAI等是扩展无限。

AI前线
产品应用8

陈天桥邓亚峰联手破解模型记忆难题!4个月打造SOTA系统,悬赏8万美元发起全球记忆挑战赛

今年全球AI圈聚焦模型记忆技术。陈天桥和邓亚峰带队的EverMind推出世界级长期记忆系统EverMemOS,发布即SOTA。其模拟人脑记忆机制,开源且上线云服务,还发起8万美元记忆起源赛。

量子位