「AI能力提升」共找到 12332 篇相关文章
9.1K Star 调参师集体失业!亚马逊造出机器学习“核弹”,3行代码打造高精度模型!
在机器学习普及的当下,自动化机器学习框架降低开发门槛。AutoGluon由AWS AI开发并开源,仅3行代码就能训练和部署高精度模型,支持多类型数据,有诸多亮点,已获9.1K Star。
103K「硬核」题,让大模型突破数学推理瓶颈
现有大语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交大团队推出DeepMath - 103K数据集。它规模大、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。
刚刚,北大校友Lilian Weng自曝公司首个产品?一篇论文未发,估值却已90亿
OpenAI前安全副总裁Lilian Weng疑似曝光90亿估值新公司Thinking Machines首个产品——手动调参仪表盘,训练中可手动调超参数。OpenAI也有AI硬件野心,设想让ChatGPT成全能硬件助手。
飞书和豆包合并后的第一个Agent产品,豆包工作,它来了。
字节发布飞书与豆包整合后的首个产品——豆包工作,它是完整办公 Agent,与飞书原生打通,功能丰富。对用飞书办公的公司而言,使用便捷,还便于管理 AI 额度,是很好的 Agent 起手式。
4.4k星!给Agent接上「本地免费搜索爬虫」,内置11个skill执行数据搜索、爬取、自动研究
文章推荐开源本地搜索工具wigolo,它是专门给Agent使用的本地网络能力层,可解决本地运行Agent查找资料时使用API麻烦费钱的问题。它功能多样,有搜索、缓存等工具,自带11个Skill。
B站爆了!Hermes首度直播回应「抄袭」,MiniMax提前杀入Harness赛点
Hermes Agent业务负责人回应抄袭质疑,技术对谈探讨AI竞争新维度。MiniMax动作密集,构建“Model + Harness”双向飞轮,其模型获海外开源圈认可,产品驱动模型优化,还与云厂商合作解决沙箱问题。
重新认识具身行业,从自变量的这封邀请函开始
具身智能行业存在评分、技能、样品、商业四大‘气泡’,即认知偏差。自变量机器人将在发布会上戳破‘气泡’,打破认知差,重建评价标准。行业‘拐点时刻’需大脑能力突破、真实场景稳定运行、跑通ROI闭环。
52k Star,Hermes Agent试图杀死OpenClaw
近期龙虾(OpenClaw)热度下降,harmess engineering大火。开源项目hermes-agent已有52.7k Star,是自学习型AI智能体,能积累技能、持续学习,可轻松切换多种模型,还给出安装、使用指南和文档教程。
如何在24GB显存里,塞下一个万亿参数的巨兽?KTransformers入选顶会SOSP
清华大学与趋境科技联合研发的KTransformers系统,可让消费级显卡跑万亿级参数模型,其论文入选SOSP 2025。该系统解决MoE模型本地部署难题,技术创新多,还与SGLang合作,提升硬件利用率。
老牌Transformer杀手在ICLR悄然更新:Mamba-3三大改进趋近设计完全体
Transformer架构仍是AI主流,Mamba作为挑战者影响力大。Mamba-3在ICLR 2026盲审,有梯形离散化、复数化状态空间模型、多输入多输出状态空间模型三大改进,实证表现佳,适合多场景。