Qwen2.5-0.5B」共找到 3942 篇相关文章

新闻资讯7

奥特曼首曝GPT-6,亲口承认GPT-5「搞砸了」!接入大脑读心,估值或飙破5000亿

奥特曼在旧金山采访中透露GPT-6相关信息,坦言GPT-5发布‘搞砸了’,GPT-6主打个性化记忆功能。OpenAI新一轮融资后估值或达5000亿美金,但投入算力成本高,其估值也存泡沫争议。

新智元
新闻资讯7

GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够

OpenAI发布GPT - 5后遭遇波折,因被批不直观恢复为GPT - 4。但它是进军企业市场举措,获部分企业认可。OpenAI联合创始人Greg Brockman谈其发展历程、瓶颈、应用等,强调让模型接触现实、提升安全性及适配团队工作。

AI前线
算法论文8

小模型用不好Skill?新范式让模型学会Skill的底层逻辑,3B模型推理token省5倍,性能反超

浙江大学联合美团龙猫团队、清华大学推出SKILL0,提出技能内化思路。它在训练中引入关键机制,让小模型把技能内化到参数里。实验显示,其效果出色,token效率高,为小模型成领域专家提供新方向。

量子位
开源动态8

超低延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!

随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完全开源,有超低延迟等优势。

开源星探
算法论文8

让AI像人类一样认知真实世界!UCLA谷歌强强联手,长时记忆+3D空间理解超越基线16.5%

如何让AI在3D环境中像人类一样思考,是具身智能领域难题。UCLA与谷歌团队带来3DLLM - MEM模型与3DMEM - BENCH基准,让AI有构建、维护和利用长时记忆能力,实验超基线16.5%,但有依赖模拟器预设的局限。

量子位
产品应用8

深夜炸场!Claude Sonnet 4.5上线,自主编程30小时,网友实测:一次调用重构代码库,新增3000行代码却运行失败

Anthropic推出Claude Sonnet 4.5,号称‘世界上最好的编码模型’,持续运行时长、推理等能力提升,‘幻觉’等问题改进,Claude Code也有更新,开发者实测有惊喜也有问题,新一轮AI‘内卷’开启。

AI科技大本营
开源动态8

AI能帮忙厨房看火了!面壁智能开源全模态模型MiniCPM-o4.5,边看边听还能主动抢答

面壁智能开源全模态模型MiniCPM-o4.5,能边看边听还主动抢答。它引入全双工多模态实时流机制,在多方向达全模态模型领先水平。该模型是端侧原生,将与开发板配套,助力端侧智能硬件开发。

量子位
产品应用8

AI短剧成了!LibTV-seedance2支持“真人模式”:一手实测,视频闪电直出,效果炸裂

LibTV首发支持Seedance 2.0真人生成视频功能,操作简单严谨。真人出镜可用于虚拟主播、数字分身、角色替换等场景。该工具工作流高效,接入主流模型,价格有优惠。

AI寒武纪
开源动态8

智谱首秀工程实战经验!Coding Agent日均数亿次调用,GLM-5把长上下文推理的底层问题全逼出来了

今年 2 月智谱 GLM Coding Plan 上线后很受欢迎,随着用户和调用量上涨,Coding Agent 成压力测试场。4 月 30 日智谱发布博客,披露 GLM - 5 系列模型在超大规模 Coding Agent 调用场景下的底层推理技术突破及工程实践经验。

InfoQ
8

中科院信工所发布首篇LLM智能体幻觉综述!梳理5类幻觉、18大诱因与10种缓解方案,300+论文资源开源

中科院信工所等机构团队发布首篇聚焦LLM智能体幻觉的综述,厘清其与传统语言幻觉区别,提出5类幻觉分类体系和18大触发原因,给出10种缓解策略,还开源300+论文库并指明未来研究方向。

深度学习自然语言处理