「员工效率」共找到 1548 篇相关文章
从传统编程转向大模型编程
文章指出大模型编程时代,开发者要从‘代码产出者’变为‘文档定义者’,介绍其优势、人+AI结对编程模式,还提及模型工具技巧、开发流程、常见陷阱及应对策略,强调文档驱动和安全合规。
不训练,解锁Agentic智能!微软:只需给LLM一台电脑
人大、MSR、清华的LLM - in - Sandbox开启「通用代理智能」新范式,把大模型放进“虚拟机”,让其在6大任务上成绩全线暴涨,零额外训练解锁“通用代理智能”,还介绍了相关实验、优化及效率情况。
0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型
上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。
大模型哪里出问题、怎么修,这篇可解释性综述一次讲清
来自多机构的研究团队发布“可实践的机制可解释性”综述,通过 'Locate, Steer, and Improve' 三阶段范式,为大模型的对齐、能力增强和效率提升提供方法论,还梳理可解释对象体系和干预手段。
离开小米后,他赌耳机才是AI硬件的最优解|甲子光年
甲子光年对话光帆科技创始人董红光。他曾是小米第89号员工,认为AI硬件分水岭是Agent OS,其创业产品以耳机等为载体,集成Agent OS,还谈到产品设计、成本、供应链、操作系统等多方面问题。
OpenAI偷袭,谷歌掀桌!2026开年第一场AI大战太精彩
OpenAI悄悄上线ChatGPT Translate挑战谷歌翻译,该工具支持超50种语言,有翻译后「二次加工」能力,但功能尚不完善。谷歌则高调开源TranslateGemma模型,支持55种语言,效率惊人,12B参数超越27B基线。
“AI火了,我们却快完了!”顶级开源框架Tailwind之父含泪裁掉75%兄弟:半年后,这个项目可能就没了
前端开源项目 Tailwind CSS 正面临生存危机。创始人 Adam Wathan 称因 AI 冲击,一天内裁掉约 75% 工程团队员工,若趋势不变,约 6 个月后无法支付工资。此前社区 PR 也因变现问题被拒。
航空学报 | 西工大余囿铮、寇家庆等:基于生成对抗网络的通航飞行器气动布局设计方法
传统飞行器气动布局设计依赖专家经验,方案多样性受限。本文基于改进的生成对抗网络,提出端到端气动布局生成框架,以机翼和通航飞行器为对象研究,验证了其在创新飞行器设计方面的潜力。
DeepSeek 模型技术之旅:从 V3 到 V3.2
本文深入剖析了 DeepSeek 模型从 V3 到 V3.2 的技术演进,对比了基座与推理模型,介绍了架构、训练方法变化,如 V3.2 结合 MLA 与 DSA,更新奖励和 GRPO 算法,还提及 V3.2-Speciale 扩展思考特性。
LLM算力告急?把文本变图片,推理成本直接减半!
大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。