「AI大模型」共找到 14236 篇相关文章

开源动态8

真牛,4千行代码,媲美OpenClaw,开源 nanobot 到底强在哪?

本文拆解GitHub热门开源项目HKUDS/nanobot,它是超轻量个人AI助理,核心功能约4000行代码,易读易扩展。支持多模型、多渠道,有定时任务和Docker用法,适用于多场景。

小华同学ai
产品应用8

Qwen3.5实战教程:从0到1掌握本地部署与微调

阿里通义千问团队发布Qwen3.5系列小模型,打破“大模型=高成本”惯例。本文全面剖析该系列模型,涵盖核心特性、本地部署实战、模型微调实战,还给出技术细节与问题解决办法。

机器学习AI算法工程
新闻资讯7

Anthropic 联创曝内部工程师已不写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?

Anthropic联合创始人透露公司工程师已不写代码,而是管理AI Agent系统,工作量达以往2 - 3倍,Claude也参与编写自身代码。Dario提议向AI公司征税,开发者对AI写代码存质疑,还提到AI测试作弊等情况。

InfoQ
算法论文8

刚刚,加入腾讯的姚顺雨发表首篇Paper~

腾讯混元与复旦联合发表论文《CL-bench》,姚顺雨署名并全面细致审阅反馈。CL-BENCH 首次单独考‘现学现卖’,有独特设计原则、四大题型,其评分杜绝‘差不多’,还让 10 个前沿模型‘翻车’。

PaperAgent
推荐文章7

2025.7.4上午 | 视觉智能驱动的多模态对齐与推理的近期系列工作分享 - 复旦博士生王思尹

本次分享由复旦博士生王思尹围绕‘视觉智能驱动的多模态对齐与推理’展开,介绍多模态大模型探索研究,涉及跨模态组合语义理解、视觉参与推理及基于视觉建模世界完成行动等内容。

深度学习自然语言处理
算法论文8

融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱

Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。

AI前线
算法论文8

刷榜只是体力活!清华消费10万块,一周「肝」出105个SOTA

AutoSOTA通过多智能体协作,将AI研究中繁琐的性能优化过程自动化,使科研从「手工艺」转向「工业流水线」。在一周压力测试中,消耗约10.4万美元,发现105个SOTA模型,平均性能提升近10%。

新智元
开源动态7

腾讯助力Deepseek完善DeepEP,RoCE提升100%,InfiniBand提升30%

Deepseek团队合并腾讯提交的代码完善DeepEP,称有巨大速度提升,RoCE提升100%,InfiniBand提升30%。DeepEP是为混合专家模型和专家并行设计的通信库,有多项创新特性,适合现代AI应用。

CourseAI
产品应用9

Claude Opus 5.5 到底强在哪?大幅降价后谁会受影响?

本文从工程视角拆解Anthropic新品Claude Opus 5.5,分析其能力升级、定价调整,分享开发者实测案例,解读此次升级对AI行业格局的影响。

AI Reading Hub
新闻资讯8

从傅盛的龙虾到汗青的加速主义,AIFUT大会Day1下午场总结都在这了。

AIFUT大会第一天下午场信息密度大。傅盛称龙虾是工具的AGI时刻;特效小哥008认为AI不替代人类但可能替代工作;辩论探讨教用AI能否教会;朱广翔说程序员岗位将减少,泛创造者会增加;李继刚指出人不可压缩的只剩体验;赵汗青探讨慢的东西如何存活。

数字生命卡兹克