大厂经验」共找到 5444 篇相关文章

新闻资讯7

爆火的 AI 玩具赛道,全行业都在等一个「成功者」

过去一年,AI玩具创业火热,众多背景创业者入局。但现状尴尬,鲜少有能售卖产品,已推出的产品反馈不佳。目前AI玩具实质多为毛绒玩具加语音盒子,创业者面临技术和成本等难题。

Founder Park
新闻资讯7

AI眼镜:又怕小米做,又怕小米不做

过去一年AI眼镜产品密集落地,小米和Rokid跻身全球出货量前三。市场处于“又怕小米做,又怕小米不做”的微妙氛围,试水但未全力投入,给中小商留下建立技术壁垒的窗口期,显示技术或成首个分水岭。

远川科技评论
算法论文8

模型「越用越快」!SpeedupLLM首次验证,降56%推理预算

Emory学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。

新智元
开源动态8

DeepSeek-R1发布后的100天复现之旅方法总结

DeepSeek团队发布「推理模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理模型与普通模型区别、复现方法、关键发现及未来方向。

深度学习自然语言处理
推荐文章8

CIO独家分享:AI如何重塑开发者未来十年

阿里云智能集团副总裁、CIO蒋林泉分享AI时代开发者发展。他指出不能用旧有标准评判价值,探讨技术贡献衡量、全栈工程师、提效顺序等问题,强调AI可助力学习和角色创新,还提及招人看重的能力和心性。

InfoQ
算法论文8

多模态模型中Attention机制暗藏「骗局」,需用一个公式修正丨上×南开

上海学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。

量子位
新闻资讯8

年复出,入局模型

国产模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈年押注本地模型,公司专注该领域商业化。

量子位
推荐文章8

揭秘模型Steering:从底层机理到系统评估,全面破解模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心
新闻资讯7

OpenAI研究模型对GDP贡献,三行业已能代替人类,并自曝不敌Claude

OpenAI推出新评估方法GDPval,跟踪模型在现实任务表现。评估显示前沿模型接近专家水平,Claude Opus 4.1表现最佳,GPT - 5准确性出色。还发布黄金子集和评分服务,其处于起步阶段将持续扩展。

机器之心
推荐文章7

端侧跑模型,现在也太简单了

作者Vicki Boykis分享本地运行AI模型体验,指出如今本地模型性能提升,像GPT - OSS、Gemma 4系列表现出色。还介绍运行本地智能体流程的设置,虽有问题,但优势多,生态值得投资。

机器之心