「开源编程模型」共找到 9489 篇相关文章
让LLM不再话痨,快手HiPO框架来了
当前LLM存在‘过度思考’困境,效率与成本矛盾突出。快手与南大合作推出HiPO框架,通过混合数据冷启动和混合强化学习奖励系统,让模型能自主决策思考模式,实验显示它提升了效率和准确率,还具强泛化性。
NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记
本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。
众所周知视频不能P?北大施柏鑫团队、贝式计算CVPR研究:视频里轻松换衣服、加柯基
视频编辑难度高,传统流程繁琐,现有AI方法有局限。北大施柏鑫团队联合贝式计算等提出VIRES方法,能实现视频主体多种编辑操作,还标注VireSet数据集。其在多指标超现有SOTA模型,团队还探索全景级可控视频生成。
AI搜索平台Glean获1.5亿美元,估值72亿美元
CNBC消息,AI搜索平台Glean完成1.5亿美元F轮融资,估值升至72亿美元。其核心产品是企业级搜索平台,可集成多应用。资金将用于团队扩张和拓展市场,但也面临激烈竞争,技术可与大模型互补。
Agent可以自己进化了?!
论文《Automated Design of Agentic Systems》提出让Agent扮演设计师,“元代理”能自动生成新代理设计方案。用编程语言作设计空间,实现“设计自由”。实战中,AI设计的Agent全领域超越人类,还具备知识迁移能力,未来或有自主进化的AI生态。
搜索SEO被AI重塑,专业内容社区价值凸显 | 量子位智库报告
量子位智库报告指出,大模型颠覆传统搜索,传统SEO正被重构。实验显示近半AI回答引源自内容社区,专业话题中占比更高,知乎被引频率最高。报告认为SEO应向SPO转变,专业内容社区价值凸显。
AI Agent 距离真正替人「全自动办公」,还有多远?
Meta、微软和 xAI 被曝监视员工操作来训练 AI,原因是真实办公中 AI Agent 表现不佳。SaaS - Bench 评测显示顶级大模型表现糟糕,智能体存在长周期任务脆弱、跨应用错误放大等问题,未来 SaaS 软件或需为 Agent 重新设计。
Claude Code之父红杉演讲震撼全场! 26年未写1行代码, 电脑都不开了
Claude Code之父Boris Cherny在红杉AI Ascent 2026大会上称,2026年至今未写过一行代码,现用手机工作。他预言编程已被AI解决,Claude Code代码库一年后或只剩100行,还认为软件业将民主化,创业公司迎来黄金时代。
马斯克祭出「霸王条款」!Cursor焊死SpaceX战车,600亿砸穿OpenAI
SpaceX筹备1.75万亿美元IPO之际,马斯克抛出600亿美元收购Cursor的期权,不买就付100亿美元。此前xAI已为Cursor提供算力,还挖走其骨干。二者各有短板,交易引发质疑,但反映编程是通往AGI重要阵地。
多 Agent 并行,手机也能用,已经 4 万星!
GitHub上项目Orca是专为「并行Agent」做的开发环境,开源4个月揽4万+ Star。它让多个Agent在独立git worktree里并行干活,互不干扰,还支持近30款主流Agent,另有多种实用功能,安装也简单。