「高效智能体」共找到 3916 篇相关文章
KV-Cache 实战策略:生产环境中的分页、固定与复用技术解析
在大语言模型推理场景中,KV - Cache 是平衡性能与成本的核心技术,但生产环境中面临诸多问题。本文聚焦其分页、固定与复用三大战术,结合原理、实践与案例,为开发者提供解决方案,还探讨了未来演进方向。
小扎噩梦来了!MSL两月爆雷8人闪辞,PyTorch元老出走实验室人心崩盘
Meta的超级智能实验室(MSL)成立仅两月,至少八位核心员工离职,不乏PyTorch元老和新招募的硅谷天才,部分直奔OpenAI。内部重组频繁、战略摇摆,Meta AI大计或翻车。
新天终启,万象智生!从AlphaGo到GPT-5,新智元十年见证ASI创世纪
2025年AI飞速发展,大模型发布密集,如OpenAI、谷歌等有诸多成果,中国造大模型也表现出色。新智元9月7日将举办十周年峰会,邀多位嘉宾探讨前沿突破,还将发布报告,人类将达ASI临界点。
很多创业者都没意识到,Deep Research 也是做 Go-to-Market 的利器
用好 Deep Research 可提升 AI 产品 GTM 效率,主流 AI 产品都有该功能。前 Meta 战略总监写实用指南,从技巧、提示词公式、工具选择等阐述,还给出 5 个 GTM 用例及提示词模板。
谷歌版小钢炮开源!0.27B大模型,4个注意力头,专为终端而生
谷歌开源Gemma 3 270M,几分钟就能完成微调,性能超Qwen 2.5同级模型。此模型小巧高效,可本地运行,还能用它构建OCR应用。它有多项亮点,适合多场景,上手简单。
哇塞,今天北京被机器人人人人人塞满了!
世界机器人大会在北京开幕,100多个新机器人亮相。智平方的爱宝机器人人气爆棚,它能用一个基座模型完成多任务。其搭载的GOVLA大模型有四大核心能力,且已在多行业商业化落地。
小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源
小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。
扎克伯格发文正式告别“默认开源”!网友:只剩中国 DeepSeek、通义和 Mistral 还在撑场面
Meta 首席执行官扎克伯格分享“个人超级智能”愿景,透露公司调整 AI 模型发布策略。此前 Meta 强调开源优势,如今态度转变,巨额投入后或暂停开源新模型,计划并行训练开源与闭源模型。
两年半后,我不再“写”代码,而是“指挥”一个AI团队
腾讯程序员分享两年半使用AI的经验,涵盖工作与生活。工作中,介绍信息处理、规划、执行、复盘等流程的AI工具及用法;生活里,提及AI在育儿、娱乐等场景的应用,鼓励开放心态尝试。
微调重要表征以增强思维链的推理能力
团队提出关键表征微调(CRFT)方法,通过信息流分析识别和优化关键表征。在八个数学和常识推理基准及两个模型系列验证其有效性,能提高推理准确率,学习参数量低,还适应少样本场景。