「大模型测试」共找到 9855 篇相关文章

产品应用8

AI不再「炫技」,淘宝要让技术解决用户每一个具体问题

技术发展迅速,淘宝力求将AI融入应用场景解决用户问题。今年3月升级AIGX技术体系,近日郑波公开淘宝全模态大模型进展,认为狭义AGI或5 - 10年到来,多模态智能成关键技术域。

机器之心
算法论文7

BLIP3-o统一图像生成与理解,多模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。

CourseAI
产品应用8

刚刚,MiniMax直接让龙虾学会自我进化,也认识「马嘉祺」了

在 GTC 2026 大会上,英伟达推出 NemoClaw。国内 MiniMax 加快‘AI 养虾’布局,推出 MaxClaw 模式。新发布的 M2.7 能力升级,在多方面表现出色,还在科研评测中获佳绩,实测效果良好,开启自我进化。

机器之心
算法论文8

IEEE TPAMI 2025 | 北京大学提出LSTKC++,长短期知识解耦与巩固驱动的终身行人重识别

北京大学周嘉欢团队在IEEE TPAMI发布LSTKC++研究成果。该框架引入长短期知识解耦等机制,保障模型学习新知识和记忆历史知识。代码已开源,研究在性能和效率上优势明显,有广泛应用价值和拓展空间。

机器之心
8

我用MiniMax Agent开发了个带后端的全栈网站,全程0代码

2025年Agent成AI领域焦点,大厂纷纷布局。作者测试MiniMax Agent,发现其有四大特点:深度研究和上下文管理强,多模态输出出色,编程能力超预期,能执行定时任务,还能开发带后端的全栈网站。

花叔
算法论文8

Google研究发现:Multi-Agent的核心竟然是Prompt设计!

Google和剑桥大学研究多智能体系统,发现提示设计影响大,有效拓扑结构占比小。提出Mass框架分三阶段优化,实验用Gemini 1.5 Pro和Flash模型,对比多种方法,在多任务上性能显著提升。

PaperAgent
新闻资讯7

claude 4摔碎了码农的饭碗~

昨晚Anthropic发布Claude 4系列模型,Opus 4编码能力强,SWE - bench测试成绩优,能完成7小时代码重构。Claude 4让完成日级任务的时间提前,各应用纷纷接入,部分产品有应对策略。

探索AGI
新闻资讯8

Karpathy自称患上AI精神病!能力没有上限,一切都是Skill问题

Karpathy在播客中称自己患AI精神病,日常工作多依赖智能体。他认为智能体能力无上限,瓶颈在使用者技能。还探讨软件变革、自动化研究、模型分化等,对就业、开源等也给出看法。

AIGC开放社区
新闻资讯7

史上最大升级!7亿周活ChatGPT逼宫,谷歌慌了,这次要把AI整个塞进Chrome

Chrome迎来史上最大AI升级,谷歌将大模型Gemini全面接入,从内置AI助手到安全防护等多方面改写使用范式。谷歌急于部署,因ChatGPT周活达7亿,AI重塑上网体验,谷歌有危机感。

新智元
新闻资讯8

硅谷豪赌2万亿!DeepSeek登顶Nature,Meta却成2025最大输家?

2025年全球AI领域风起云涌,AGI祛魅,ASI登台。AI模型能力跃升,投资热潮推动基建扩张,劳动力变革加速,应用扩展到生活。科技领袖对AGI和ASI到来时间存分歧,中国开源AI崛起,DeepSeek成黑马。

新智元