「产品评估」共找到 2266 篇相关文章
OpenClaw 走红背后:Agent、AI Coding 与团队协作的新问题
InfoQ《极客有约》X QCon 直播栏目邀请专家探讨 OpenClaw 爆火、使用体验等问题。指出它并非低门槛产品,AI Coding 核心问题是不稳定与不可控,还讨论了团队落地方式及未来 AI Coding 可能的拐点。
ChatGPT和Claude争了个寂寞!用户重叠仅11%,中国应用霸榜移动端
风投机构a16z发布“迄今最受消费者喜爱的Top100 AI应用”榜单。前50个移动AI应用近半来自中国团队,用户多在海外。ChatGPT领先但挑战者来势汹汹,其与Claude用户重叠仅11%,全球形成三大AI市场。
DeepMind新论文炸锅:AI全自动进化算法,写出专家都想不到的解,网友:这可能就是“王牌”
谷歌DeepMind让LLM驱动的智能体AlphaEvolve改写、进化算法代码。选定CFR、PSRO框架,只开放关键决策逻辑给LLM,通过生成、运行、评估、筛选循环,进化出VAD - CFR和SHOR - PSRO算法,表现超人类手工版本。
特朗普刚下禁令,美军动用Claude空袭!军用版或已达Opus 5.5水平
WSJ报道,特朗普刚封杀Claude,美军就用其空袭伊朗。美军多司令部用Claude做情报评估等。Anthropic为军方定制版或达Opus 5.5水平。Anthropic曾因隐私等问题与五角大楼谈判破裂。
内存涨价,千元机的天塌了
去年下半年起存储芯片涨价,因AI基础设施需求爆发,三大存储芯片厂产能被榨干。消费级产品供应受挤压,中低端手机成最大受害者,各厂商搁置低价产品线,中低端市场持续萎缩。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
我用AI做了个付费榜第一的App,现在人民日报管这叫「手搓经济」
人民日报提出「手搓经济」,指个人开发者用AI做出的应用受青睐。作者作为亲历者,认为报道判断准,但应注意手搓动机是创造、参与者不止年轻人,且产品从1到100仍需投入。
登顶Hugging Face论文热榜,LLM重写数据准备的游戏规则
企业数据团队面临数据准备难题,传统方法依赖人工规则,有诸多局限。上海交通大学等机构研究团队综述指出,LLM正推动数据准备从“规则驱动”向“语义驱动”转变,还给出技术选型、评估基准及工程指南。
燃尽、重启、爆火:Clawdbot 创始人的 35 分钟访谈实录
本文是 Clawdbot 创始人 Peter Steinberger 的访谈实录。他曾经营 PSPDFKit 13 年,后经历三年倦怠期。2024 年受 Claude Code 启发,10 天做出 Clawdbot,几周内 GitHub 星标近 9 万。还谈及模型看法、改名风波及产品前景等。
黄仁勋现身深圳参加年会:没抽红包、没谈芯片、没邀外部企业|甲子光年
1月28日晚,英伟达创始人黄仁勋现身深圳年会。他发言简短,未提芯片进展,抽奖无万元红包,也未邀外部企业。此次来华他在产品业务上低调,或因出口管制,不过私下更“接地气”。