「AI性能」共找到 10949 篇相关文章

8

一年成爆款,狂斩 49.1k Star、200 万下载:Cline 不是开源 Cursor,却更胜一筹?!

AI编程助手市场看似火热,实则盈利艰难,如Cursor等工具亏本运营。Cline选择开源,坚持软件免费、服务变现,一年成爆款。其创始人分享了产品理念、技术选型、市场定位等,还探讨了MCP生态、编程智能体发展等话题。

AI前线
推荐文章7

谁为 Data Agent “买单”?

Kyligence联合创始人李扬围绕AI数据智能体服务对象及带来的转变分享思考。它能解决领导数据客观性、时效性等问题,也助分析师深入研究,最大价值是让业务人员从0到1用上数据,推动企业数智化转型。

InfoQ
开源动态8

国产LLM又迎来一波开源潮:Qwen、华为盘古、腾讯混元、小米~

本周国产开源LLM集中爆发,Qwen、华为盘古、腾讯混元、小米等接连发布模型。如Qwen3 - 4B性能提升,Qwen - Image文生图能力强;华为开源盘古模型并宣布CANN开源;腾讯混元小尺寸模型特点多且已落地业务。

PaperAgent
新闻资讯7

用户集体大逃亡!Cursor“自杀式政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎

很多开发者吐槽并弃用 Cursor,因其付费后砍功能、技术变差、营销像‘障眼法’,引发信任危机。部分用户转向 Claude Code,不过企业侧使用情况有差异。AI 编程工具竞争激烈,需多维度构建优势,市场未来趋势明显。

AI前线
算法论文8

答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

本文介绍南洋理工大学等机构研究团队提出的V-Rubrics方法,解决多模态推理中结果正确但推理错误的奖励分配误区,通过35万条细粒度准则拆分奖励计算,有效提升模型性能,论文已被EMNLP 2026主会接收,代码与数据已开源。

机器之心
推荐文章7

为什么资深开发者讲不清自己的专业能力

文章探讨资深开发者讲不清专业能力的原因。指出公司存在业务团队消除不确定性和开发者管理复杂性两个循环,开发者因用自身逻辑沟通而失败,还给出沟通口诀,最后提到AI虽能快速写代码,但开发者仍需承担责任。

宝玉AI
产品应用8

全网爆火的龙虾总失忆?大佬亲自下场手搓解药,终结致命痛点

OpenClaw项目爆火,但龙虾存在「失忆」问题。TiDB联合创始人黄东旭发布免注册的永续记忆服务mem9.ai,解决其记忆痛点。它一虾一库、免注册、支持备份迁移等,还上线个人记忆空间,与OpenClaw官方架构深度配合。

新智元
算法论文8

突破单token预测局限!南洋理工首次将多token预测引入微调,编程任务准确率提升11.67%

当前主流大语言模型依赖下一token预测训练,难理解跨多token完整概念。南洋理工大学提出概念感知微调(CAFT)技术,首次将多token预测引入微调,能让模型理解完整概念,多领域实验显示其可显著提升模型性能。

量子位
新闻资讯8

梁文锋、马斯克同时开火!DeepSeek V4 Pro,Grok 4.6 发布

刚刚,DeepSeek悄悄上线DeepSeek V4 Pro正式版,马斯克高调推出Grok 4.6,两者性能直逼顶级闭源甚至有超越。每百万输出Token,Grok 4.6和DeepSeek价格优势明显。两者在多项评测中表现出色,且后续还有大招。

AIGC开放社区
新闻资讯7

半年不写代码,Claude Code之父:3年后写代码的人暴涨100倍

Claude Code之父Boris Cherny称,虽软件工程师职称或消失,但3年后写代码、用智能体的人会是现在100倍。他列出Claude Code团队的5种角色,指出岗位边界在融化,AI时代清理者角色更关键。

新智元