「开源小模型」共找到 9341 篇相关文章
刚刚,DeepSeek 突发梁文峰署名新论文:V4 新架构提前曝光?
今天凌晨,DeepSeek在其GitHub官方仓库开源了新论文与模块Engram。该论文提出“查—算分离”机制,通过引入可扩展的查找记忆结构,在等参数、等算力条件下提升模型表现,代码与论文全文均已开源。
视频生成太慢?英伟达、谢赛宁等发布TMD框架,实现70倍加速
大规模视频扩散模型采样效率低,应用受限。英伟达联合谢赛宁等提出TMD框架,将大型视频扩散模型蒸馏为少步生成器。实验显示,TMD能实现超70倍加速,质量损失小,用户也更偏好其生成的视频。
Claude Opus 4.7发布!这是你在别的公众号看不到的五个发现
Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。
灵初智能陈源培:一个 00 后的机器人之梦
00 后陈源培是灵初智能联创,本科土木工程专业,大二因比赛对机器人感兴趣。他研究灵巧手,参与开源项目,灵初发布相关模型。他认为强化学习对灵巧手重要,还谈了模型、创业、落地等看法。
狂涨 36.9K star!!看看人家的开源微信机器人多优雅,微信、飞书、钉钉支持,效率飙升!
开源君介绍超火的开源项目`chatgpt-on-wechat`(CoW),它结合大模型与社交、办公平台,可定制优化。能接入多平台,支持多模型,处理多模态消息,有丰富插件,还能记忆会话、定制知识库。给出安装步骤。
梁文锋,Nature全球年度十大科学人物!
权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。
重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个
DeepSeek-OCR模型探索视觉-文本压缩边界,用少量视觉token解码出10倍以上文本信息。它在OmniDocBench基准上表现超GOT-OCR2.0,为LLM长上下文问题提供方案,还能处理多类图像与近100种语言。
云厂商「进击」 Agent 开发平台
企业级智能体(Agent)市场崛起重构云服务竞争格局,云厂商需提供全栈能力。腾讯云宣布智能体开发平台3.0上线,优图实验室关键技术持续开源。文中还分析企业开发Agent难题及腾讯云应对举措。
刚刚,智谱砍掉OpenClaw最大门槛!1分钟装好,一键塞进飞书
OpenClaw爆火但安装门槛高,催生天价代装生意。智谱发布AutoClaw(澳龙),将其打包为一键安装桌面应用,小白1分钟上手。内置Pony - Alpha - 2模型,支持模型热插拔与飞书集成,50 + 技能开箱即用。
DeepSeek 跃居全球第二 AI 实验室,中美正式并驾齐驱!
Artificial Analysis宣称DeepSeek R1跃居全球第二,其0528版得分达68分,与Google Gemini 2.5 Pro并列。更新体现强化学习的重要性,多家云服务提供商也迅速支持新模型,这表明开源与闭源模型差距缩小,中美AI并驾齐驱。