「轻量模型」共找到 8194 篇相关文章
印奇的智驾困局|甲子光年
2026年初,印奇身兼千里科技与阶跃星辰董事长。千里科技转型后目标是让千里智驾上车量达百万辆,但面临市场反馈不佳、财务亏损等困局。他选择整合两家公司,借助阶跃星辰突围。
一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布
模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。
企业级靠谱龙虾升级,拒绝失控
OpenClaw爆火又降温,凸显轻量化智能体短板,企业需具精准业务理解和多技能协同能力的AI员工。滴普科技升级Deepexi企业大模型,其与两平台构成DeepexiOS,支撑企业AI体系化建设。
ICML 2026 | Agentic强化学习训练的信息自锁问题
随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。
ICCV 2025万篇投稿破纪录,作者被逼全员审稿!网友痛批不如GPT
ICCV 2025论文投稿量达11152篇创纪录,评审结果公布后引热议。网友吐槽部分评审意见质量差,还有作者不满全员审稿制度。大会禁止用大模型评审,也暴露了同行评审流程的官僚问题。
Agent架构搭建 ≠ 堆Skills
现在很多Agent架构以大量Skills为基础,但这种做法大概率会翻车。Skills机制让模型自行判断是否使用及何时使用技能,其判断不可靠,随着技能数量增多,系统可靠性变差,设计上需平衡灵活性与可控性。
马斯克放出编程界价格屠夫!Grok Code Fast 1:更快,更省,还免费
近日,马斯克旗下xAI发布全新编程模型Grok Code Fast 1,它为“代理式编程”而生,靠全新架构实现高速代码生成。在技术出色的同时,价格低廉还限时免费,虽在部分场景有不足,但仍是开发者实用工具。
实测腾讯云 AndonQ:号称比肩原厂技术专家的 “领域虾”,到底有多能打?
文章实测腾讯云 AndonQ,它号称全球首款 ITSM“领域虾”,可适配主流“虾”类工具,集成至 IM Bot。测评显示其成本低、上手轻量,在架构选型、故障排查等场景表现出色,将 ITSM 体系浓缩到对话框。
阿里妈妈发布MUSE:用多模态搞定十万级超长行为序列,并开源Taobao-MM数据集
阿里妈妈与武汉大学团队发布 MUSE 框架,用于终身用户兴趣建模,能处理 10 万级超长行为序列。还开源 Taobao - MM 数据集。MUSE 可插拔,已在阿里妈妈展示广告精排模型全量上线,提升 CTR 等指标。
Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌全参数微调
Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌全量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。