「策略性能提升」共找到 4638 篇相关文章
阶跃开源JetSpec,大模型推测解码提速近10倍
随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。
360 如何用 AutoMQ 解决千亿级 Kafka 冷读难题
360 集团作为互联网安全公司,业务数据规模膨胀,Kafka 集群运维难题凸显。AutoMQ 存算分离等特性适配 360 需求,360 验证其性能后用于日志检索平台,解决冷读难题,未来将推广到更多业务线。
GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!
GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析器可自动定位元素,请求器能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。
卡帕西推荐的AI Coding指南:3招教你效率翻倍
大神卡帕西和OpenAI总裁转发推荐的AI Coding指南,由Peter Steinberger撰写。指南给出三大关键策略,即按任务类型选对模型、重构工作流、做好人机分工,还分享实用小技巧。
刚刚,「欧洲的DeepSeek」发布Mistral 3系列模型,全线回归Apache 2.0
Mistral AI发布Mistral 3系列开放模型,含Ministral 3和Mistral Large 3,均采用Apache 2.0许可证。该系列模型性价比高,性能出色,还与多方合作。其发布或标志欧洲重返AI竞赛,也是对DeepSeek的追赶。
团队授权:分散化的架构决策
文章以黏菌创建网络为隐喻,探讨软件团队去中心化架构决策。介绍转型历程,包括重组团队、建立建议流程、创建上下文图等,阐述各环节作用、挑战与收益,强调其能提升决策质量与团队参与度。
AI到底会不会取代我们的工作?
作者分析2023 - 2025年10月近1.8亿份全球招聘启事,发现2025年总招聘岗位降8%。创意执行岗、基层员工岗位减少,而创意策略岗、高层领导岗位降幅小。客服、软件工程师岗位较坚挺,机器学习等岗位逆势增长。
让LLM扔块石头,它居然造了个投石机
港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。
为什么 OpenAI 们都要搞 AI 基建?Groq 创始人把背后的逻辑讲透了
文章通过对Groq创始人Jonathan Ross的访谈,探讨AI基建问题。指出AI应用增长受限算力,算力提升易见效,自研芯片可掌控命运。还分析芯片制造难点、市场供需、能源需求等,预测AI将带来用工短缺和新产业。
DeepSeek-R1登顶Nature,8位专家严审通过, 大模型「交卷时刻」来了
近日,DeepSeek - R1登上Nature封面,打破主流大模型未经过独立同行评审惯例。同行评审可理清模型机制,提升透明度与可信度,还能避免‘刷榜’‘自评’,虽有公司担心泄密,但它是验证成果的必要程序。