「小模型超越大模型」共找到 8324 篇相关文章
重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个
DeepSeek-OCR模型探索视觉-文本压缩边界,用少量视觉token解码出10倍以上文本信息。它在OmniDocBench基准上表现超GOT-OCR2.0,为LLM长上下文问题提供方案,还能处理多类图像与近100种语言。
告别多奖励跷跷板:Flow-OPD将多教师OPD带入图像生成
中国科学技术大学等机构团队提出Flow - OPD,这是首个将OPD引入流匹配模型的统一多任务后训练框架。它解决了流匹配模型后训练对齐中多任务的梯度冲突等问题,效果良好,未来有多个拓展方向。
刚刚,智谱砍掉OpenClaw最大门槛!1分钟装好,一键塞进飞书
OpenClaw爆火但安装门槛高,催生天价代装生意。智谱发布AutoClaw(澳龙),将其打包为一键安装桌面应用,小白1分钟上手。内置Pony - Alpha - 2模型,支持模型热插拔与飞书集成,50 + 技能开箱即用。
AI开始改进“改进自己的方法”,RSI进入平方时代丨MetaRSI
本文介绍CosmosMind联合十余家海内外高校,发布全球首个统一三类RSI的元递归架构MetaRSI-v1,实现AI改进自我改进过程,在大小模型均获显著性能提升,提出统一范式与五大定律并开源项目。
LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了
华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。
从技术狂欢到企业落地,智能编程的全球破局战
智能编程是AI应用增长快的赛道,正从代码补全迈向AI自主开发。国内模型能力提升,阿里Qwen3 - Coder超越部分闭源模型。阿里云通过多策略破局,其产品助力企业落地,但仍面临适配、安全等挑战。
字节跳动内部信:大幅调薪+职级洗牌;千问“干死豆包”图疯传,阿里回应;六小龙IPO战打响,MiniMax、智谱率先过聆讯|Q资讯
本文汇总多则科技资讯。如字节跳动调薪并推行新职级体系;阿里回应千问‘干死豆包’图为AI生成;马斯克薪酬方案裁决恢复;OpenAI发布编程模型;小红书、腾讯等也有业务动态。
ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频
在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。
AI 的“思维链”推理是海市蜃楼吗?
亚利桑那州立大学论文《大语言模型的思维链推理是海市蜃楼吗?》认为思维链推理在数据分布偏移时易出错,可能只是对训练数据模式的记忆。作者 Sean Goedecke 认为该论文结论不合理,从推理与语言、模型规模等方面提出反对意见。
让AI自我进化,斯坦福新课免费教
斯坦福开设新课CS329A《自我进化AI智能体》,被奉为Agent学习新晋资源宝库。课程由实战派教授授课,介绍扩大模型规模、养成能听懂人话的AI、提升AI能力等内容,还探讨AI自我改进及智能体工作流等。