「领域大模型」共找到 9970 篇相关文章
本地Opus你要不要!Qwen3.8-27B开源
阿里Qwen团队开源Qwen3.8-27B,上线2天登顶Hugging Face全球大模型趋势榜,下载破百万。其性能超Opus4.6,与顶尖模型相当,量化后普通电脑就能跑,原生多模态,编程、Agent、多模态跑分表现出色。
代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相
新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。
首发Omni-Flow流式全模态架构,消费级显卡就能跑
面壁智能等联合发布MiniCPM-o 4.5技术报告,公开Omni-Flow流式全模态框架。该模型凭9B参数实现端到端全双工全模态,可在消费级显卡运行,还推出在线体验Demo等,性能表现佳,应用潜力大。
具身智能机器人年度总结,来自英伟达机器人主管
英伟达机器人主管Jim Fan在2025年末判断机器人领域仍处蛮荒时代。他指出该领域缺乏统一评测体系,硬件进展快但可靠性不足限制软件迭代,VLM→VLA技术范式有问题,还分享了数据、模型等方面情况。
ChatGPT本来要5天后关掉
翁家翌在播客透露,起初推出ChatGPT是为收集用户数据,预期5天后关闭。他是OpenAI多代大模型发布贡献者,还分享了OpenAI内部情况,如模型训练、迭代速度等问题,也谈及自身经历和对AGI看法。
LLM+RL遭严重质疑,随机/错误等虚假奖励也能提升至标准效果?
论文在AI领域观察到类似随机给糖或奖励错误答案让孩子成绩提升的现象,‘虚假奖励四大奇招’效果接近用标准答案训练,Qwen2.5 - Math - 7B模型在测试集上性能飙升,还揭示了Qwen特别的原因及随机奖励有效的推手。
曝梁文锋不满内部会议泄露,DeepSeek或暂停新融资;卡帕西入职Anthropic仅两月疑离职;日媒拆解宇树G1后认输:短期内赶不上中国|AI周报
这篇AI周报涵盖多则热点,如DeepSeek因会议纪要外泄或暂停融资;AI大神Karpathy入职Anthropic两月引离职传闻;美国指控K3蒸馏大模型,黄仁勋等支持开源AI;还有企业人事变动、模型发布及应用等消息。
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4
近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。
“现在的AI就像1880年的笨重工厂!”微软CSO斯坦福泼冷水:别急着造神
微软首席科学官 Eric Horvitz 在斯坦福商学院演讲,称当下 AI 如 1880 年代刚用电的工厂,底层大模型与商业未契合。他指出模型概率校准不足、医疗 AI 难移植等问题,还谈及人类与 AI 协作及内容溯源等。
推荐系统进入「双动力」时代!首篇LLM-RL协同推荐综述深度解析
强化学习是推荐系统主流建模范式,但传统 RL 推荐系统有诸多瓶颈。大语言模型崛起带来新机遇,LLM 与 RL 结合开启新范式。研究团队发布首篇相关综述,提出五大协同范式,总结评估体系,分析挑战与方向。