「AI coding agent」共找到 10866 篇相关文章
GPT-5刷屏吊胃口之际,英伟达发出暴论:小型语言模型才是未来
英伟达新论文指出,未来属于小型语言模型(SLM),挑战了智能体需用大型语言模型(LLM)的假设。SLM参数量低于100亿,有低延迟、低成本等优势,还给出从LLM到SLM迁移路线图。
Meta华人新秀毕树超,重磅爆料下一代LLM路线!RL+预训练直通AGI
OpenAI前研究员、Meta成员毕树超在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。
共青年之智,铸AGI未来|2025 WAIC云帆奖得主名单揭晓
2025年7月27日,2025 WAIC云帆奖颁奖典礼在上海举行,公布了「璀璨明星」「明日之星」及提名奖得主名单。活动由多机构联合主办,汇聚产学研资力量,众多知名人士出席颁奖。文章还介绍了各位得主的成就。
Lovable 完成 2 亿美金融资,Newsletter 产品 Beehiiv 年营收突破 3000 万美金
Vibe Coding 产品 Lovable 完成 2 亿美元 A 轮融资,估值 18 亿美元。其活跃用户 230 万,付费用户超 18 万,ARR 近 9000 万美元。Newsletter 产品 Beehiiv 年营收突破 3000 万美元,创始人分享 20 条创业思考。
2025 上半年具身智能融资复盘:金额超 200 亿、头部收敛趋势明显、传统制造业巨头增多
2025上半年具身智能融资火热,截至7月16日融资事件130件,预估总融资超200亿。资本从大模型转向具身智能,且向头部企业聚拢,大厂与传统制造巨头积极投资,不过行业仍处早期,上市前景待察。
最新 AGI 暴论:强化学习的「GPT-3 时刻」实现,还需要 1 万年?
国外AI初创公司Mechanize三位创始人联合撰文称,RL或迎“GPT - 3时刻”,但需数千至上万年“模型处理任务所用时间”训练。还提出“复制训练”新范式,能磨炼模型能力,补足短板。
首次综述「边-云协同计算」,分布式智能与模型优化的最新进展
边缘 - 云协同计算整合边缘节点和云端资源,解决传统云计算问题。最新综述论文系统梳理其架构设计、模型优化等方面,提出统一框架,还指明未来研究方向,如大语言模型部署、6G整合等。
OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!
半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。
Transformer死角,只需500步后训练,循环模型突破256k长度泛化极限
线性循环模型能处理极长序列,是相比Transformer的关键优势,但过去循环模型性能不足且难以泛化。CMU等研究者证明,通过简单训练干预,循环模型500步后训练可突破256k长度泛化极限。
Karpathy最新脑洞「细菌编程」:优秀的代码应该具备细菌的三大特质
大神Karpathy提出“细菌编程”新概念,代码要有小而精、模块化、自包含且易复制粘贴的特点,让开源社区发展。他还提出过“软件3.0”“氛围编程”等概念,这些脑洞或成未来编程范式信号。