「大厂工作」共找到 5815 篇相关文章
大语言模型 + 编程智能体 = 安全噩梦
作者结合黑帽大会英伟达演讲,指出大语言模型和编程智能体扩大攻击面。如攻击者利用公共资源留恶意指令,实施水坑攻击。强大编程智能体虽普及,但易造成安全漏洞,虽有防御措施但效果有限。
玻尔兹曼入住南京大模型产业集聚区
玻尔兹曼宣布入驻南京大模型产业集聚区。虽24年拿牌照后营收不及预期,上半年业务失利,但反思发现产品力尚可,只是运营推广欠佳,后经与投资人交流及自我思考,坚定业务发展信心。
大模型终于能“听懂”云操作了?
本文介绍通过MCP Server和大模型结合实现云产品管理的自然语言操作。作者分享上手体验、探究原理、进行代码验证,解决使用问题,还提出后续优化方向和未来展望,如拆分MCP Server、建立云产品Agent等。
大模型的价格战,打到硅谷了
今年夏天,AI价格战风向改变,OpenAI酝酿降价从Anthropic抢客户。7月,Anthropic推半价平替Claude Opus 5,此前OpenAI发布GPT - 5.6打性价比。价格战因大模型购买逻辑变化、头部差距难支撑溢价等引发,虽让应用层受益,但对模型公司是资本耐力赛。
一文读懂:GPU到底是怎么工作的?
文章详细介绍GPU工作原理,对比其与CPU差异。指出GPU擅并行计算、能解决复杂问题,还分析FLOPS、延迟、内存等因素对性能的影响,最后讲了GPU通过多线程和超量订阅获高吞吐量。
梁文锋,Nature全球年度十大科学人物!
权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。
大概念模型:AI 推理的新范式
大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。
一篇多模态大模型推理技术最新综述
华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RL在LLMs/MLLMs中的关键设计与优化策略,还涉及多模态大模型推理多方面内容。
清华唐杰新作:大模型能打掼蛋吗?
清华、北邮等团队联合研究表明大模型能打掼蛋等8种棋牌。不同模型在不同棋牌表现有差异,如GPT - 4o综合佳,GLM4是“全能型选手”。研究还探讨学习方法、模型性能影响因素及游戏间相互作用等。
一家新能源大厂,如何撑起全球最大AI算力超级单体?
8月6日,远景科技集团在乌兰察布宣布「远景乌兰察布星河基地」投产,全球最大AI算力超级单体亮相。随着算力扩张,电力从配套成核心,远景将新能源转化成稳定算力能源,交付可承载大规模算力的基础设施。