全栈工程师」共找到 2247 篇相关文章

推荐文章8

Thinking Machines又发高质量博客:力推LoRA,不输量微调

Thinking Machines 博客力推 LoRA 并与量微调对比。研究发现小数据量任务中 LoRA 与量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近量微调。还揭示了 LoRA 关键要素、超参数规律等。

机器之心
新闻资讯8

谷歌AGI底座降临!首个原生模态嵌入模型上线,已实现模态SOTA

谷歌发布首个原生模态 Embedding 模型 Gemini Embedding 2,将文本、图、音视频及 PDF 融于统一向量空间,实现跨模态检索,降低架构成本,赋予 AI 连贯「记忆」,是重塑 AI 基建的里程碑。

新智元
新闻资讯8

“AI 工程师”已上岗!微软 CEO 曝正尝试新学徒制模式:内部工程师的顶级实践

在达沃斯论坛上,微软 CEO 萨蒂亚·纳德拉与英国前首相聚焦 AI 应用话题。他以自身参会准备工作变化,说明 AI 打破传统层级架构。还指出企业 AI 应用有‘杠杆效应’,人才差距在应用推进力度,判断泡沫关键在于落地。

AI前线
新闻资讯7

HF Papers 直播 AI Insight Talk| Omni模态专场

由多平台联合发起的【AI Insight Talk】系列直播活动第五场 - Omni模态大模型专场于2025年11月18日10:00 - 12:00直播。多位模态模型核心研发者将分享技术,还有圆桌对谈。

Hugging Face
开源动态8

刚刚,美团开源模态龙猫模型,和 ChatGPT 大战 100 回合打得难解难分

美团发布开源模态 MoE 模型 LongCat-Flash-Omni,参数 560B 激活 27B。它有真正模态能力,采用创新架构和训练范式,基准测试表现亮眼,部分指标超 Gemini-2.5-Flash,引发网友热议。

AGI Hunt
开源动态7

Headroom:Netflix 工程师开源的上下文压缩工具,省 token 还是烧 token?

Netflix工程师Tejas Chopra开源Headroom,定位为AI Agent的上下文压缩层,压缩工具输出等内容,有可逆压缩等特性。官方数据显示节省token效果好,但微软工程师实测结果中性偏负面。

AI工程化
推荐文章8

AIGC生命周期业务风控白皮书,从备案到运营的合规与安实践

2025年9月15日《人工智能安治理框架》2.0版发布,为AI风险防控指明方向。数美科技发布《AIGC生命周期业务风控白皮书》,构建生命周期业务风控体系,涵盖合规备案、安评测、账号与内容风控等多方面。

AI前线
开源动态8

1.58bit不输FP16!微软推出新模型蒸馏框架,作者是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近精度模型,降内存开销、提推理速度,作者是微软研究院华人。

量子位
产品应用8

Artificial Analysis 榜单第二,SkyReels-V4 宣告 AI 视频进入「统一」阶段

昆仑天工的 SkyReels-V4 在 Artificial Analysis 文生视频榜单排第二,ELO 评分 1090。它有「运动参考」能力,能覆盖视频创作工作流,背后靠统一拼接框架和双流 MMDiT 架构,体现 AI 行业「统一」趋势。

Founder Park
开源动态8

3A大作!阿里ROLL团队从基建->算法->机理,推动RL4LLM协同优化

阿里巴巴ROLL团队联合高校推出「3A」协同优化框架,推动「强化学习用于大语言模型(RL4LLM)」迈向新范式。Async架构提升GPU利用率,AsyPPO降低计算资源消耗,Attention机制提升训练效率与可解释性。

机器之心