「Code-LLM」共找到 1849 篇相关文章
LLM 竟然会内省!Anthropic 整了个大活:首次揭开 AI 意识
Anthropic最新研究《大语言模型中涌现的内省意识》,首次通过直接操控模型内部状态验证AI能否觉察自己思想。研究采用概念注入技术,发现AI有内省能力,且不同模型表现有差异。
AI Coding 长文分享:如何真正把工具用起来,从原理到实践
本文系统分享高效使用AI编程工具的方法,涵盖底层机制、提升对话质量的方式、实际应用场景,还推荐结合AI的编码最佳实践,旨在助开发者用好AI工具。
Claude Code 豪气收购一家0收入前端公司:押注一位高中辍学创始人
当地时间12月2日,Anthropic宣布收购热门开发者工具初创公司Bun。此次收购标志其向开发者工具领域迈进,因Bun能解决智能体分发和运行效率问题,且被众多AI编程工具使用。
知识增强LLM与搜索引擎用户的感知信息价值差异比较研究
研究选取文心一言与百度搜索引擎,探究不同任务复杂性、信息获取场景下,用户使用两种工具后的感知信息价值差异。发现两者在部分指标有显著差异,还给出两类工具优化建议。
CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning
大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。
0.01%参数定生死!苹果揭秘LLM「超级权重」,删掉就会胡说八道
苹果研究人员发现大模型中极少量的「超级权重」,即便占比仅0.01%,对模型能力影响巨大。这一发现为大模型「科学瘦身」提供思路,还提出定位方法,助力模型量化和未来研究。
企业数据“LLM ready”与“小Palantir”们的崛起 | AGIX PM Notes
文章指出当前 AI 仍处准备阶段,企业数据未就绪是落地大障碍,深层问题是流程 AI 原生化转型。还介绍本周市场、多家科技企业动态,以及巴菲特和芒格对 ETF 的看法及投资建议。
LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考
随着推理大模型和思维链普及,大模型有了‘深度思考’能力,但现在有些偏科,简单任务也复杂化。AI大牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,大模型发展不能只追求分数。
五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来
近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练自回归大模型多 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。
AI Coding 赛道,Solo 创业、6 个月 8000 万卖掉,独立开发的新传奇
Maor Shlomo开发全栈无代码平台Base44,6个月获25万用户后8000万美元卖掉。他复盘了从搭建到推广的全流程,分享产品切入点、与AI协作、渠道增长等经验,强调做喜欢之事,把握用户‘顿悟时刻’。