「大型语言模型」共找到 8070 篇相关文章
AI 陪伴赛道,会诞生下一个「泡泡玛特」吗? | GAIR Live
AI科技评论组织“AI陪伴”线上圆桌,多位从业者探讨AI陪伴是否伪命题、不同人群接受度、产品核心价值等,还讨论IP对AI硬件的重要性、硬件与软件优势、是否出海等问题。
Devin 教你做 Agent:把 AI 当做需要指导的初级开发者
Cognition团队发布编程智能体实践指南,以把AI当初级开发者的心智模型为基础。介绍与智能体沟通原则及融入日常工作流的场景,还分初、中、高级给出任务处理方法,也提及局限性、使用建议和安全管理等内容。
硅基流动完成新一轮数亿元融资,打造开发者首选生成式 AI 开发平台
硅基流动完成数亿元 A 轮融资,由阿里云领投。创始人袁进辉称业务因开源大模型崛起和算力需求激增爆发式增长。公司推出高性能推理引擎等,产品服务多个行业,未来将深耕创新、推动 AI 应用。
Token纪元:从「马力」到「人天」再到「兆字元时」的认知革命
文章指出,AI时代需全新生产力计量单位“马斯”。字元是AI“语言燃料”,但缺乏统一计量体系。智能社会的容量、速度、价格是关键指标,当前AI算力网络停在2G时代,AI劳动力崛起将重构就业,Token或引发文明跃迁。
为什么Cline不对你的代码库进行索引(以及为什么这是好事)
用户常问Cline如何处理大型代码库,是否用RAG索引全部代码。Cline特意选择不对代码库进行索引,因为传统RAG方法用于代码库有逻辑切割、索引过时、安全风险等问题。Cline像开发者一样处理代码,有独特优势。
成熟工程师1天完成调试,AI工程实践被MCP彻底颠覆?
去年11月Anthropic发布模型上下文协议(MCP),开发者社区迅速采用,AWS、GitHub、OpenAI等也已采用。MCP标准化数据和工具与AI代理的集成,简化定制化AI应用构建。采访华院计算杨小东,解析其架构、应用及商业价值。
太狠了!为了锁死DeepSeek,Anthropic要求加大AI芯片出口管制
全球著名大模型平台Anthropic发布文章,赞同并建议特朗普制定更激进规则限制AI芯片出口,以保持美国在与中国AI竞争中的领先地位,还污蔑中国运输芯片方式,拿DeepSeek举例说明芯片限制影响,并提出三点限制建议 。
突发,Claude刷新物理学世界纪录!单挑基于杨振宁理论9圈难题
本文报道Anthropic的Claude攻克理论物理前沿难题,成功算出平面N=4超杨-米尔斯理论六粒子振幅的九圈结果,打破人类此前保持的八圈纪录,计算成本仅几千美元,展示了大模型在科研领域的突破性能力。
答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励
本文介绍南洋理工大学等机构研究团队提出的V-Rubrics方法,解决多模态推理中结果正确但推理错误的奖励分配误区,通过35万条细粒度准则拆分奖励计算,有效提升模型性能,论文已被EMNLP 2026主会接收,代码与数据已开源。
百度百舸演讲:用 Agent 优化 SGLang,从改Kernel修改到端到端验证
本文是百度百舸与SGLang联合Meetup的分享整理,讲解如何让Agent完成从瓶颈定位、Kernel修改到端到端验证的全流程SGLang性能优化,覆盖多类模型场景,公布实测性能提升数据与百度百舸的通信优化效果。