「AI 模型」共找到 13714 篇相关文章

开源动态7

极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning

大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。

AIGC开放社区
算法论文8

ACL 2026 | 赋予视频生成「视觉思维链」:VChain显式建模时空规划与状态演变

南洋理工大学团队在ACL 2026发表VChain框架,引入大模型视觉推理能力提升视频逻辑连贯性。它分三步实现,实验效果超现有方法,还展示视频推理与生成的潜在趋势,为多模态模型协作提供范例。

机器之心
产品应用7

The Batch: 978 | DeepSeek-V4-Pro 更新了

DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型在多指标表现佳,编码能力改进明显,公司公开基准测试框架意义大。

DeeplearningAI
产品应用8

豆包,即将杀死比赛

本文讲述作者在不同场景的经历,展现豆包在大众心中的高认知度。还提及豆包用户规模领先、被业内人士使用、成内容创作热点等,且将深度嵌入春晚,或强化“AI = 豆包”印象。

特工宇宙
新闻资讯7

亚马逊Alexa+助手用户数量超过100万

Techcrunch消息,亚马逊升级版AI助手Alexa+自2025年2月推出后用户稳步增长,6月底未全面公测时已超百万。它体验个性化,有新能力,还能促使用户行动,初步合作多知名平台。

AIGC开放社区
开源动态7

“龙虾之父”接连点赞,星标 5k+:有道龙虾李良才拆解全场景 Agent 演进逻辑与 Vibe Coding 实战

网易有道推出国内大厂首个 100% 开源 Agent 产品有道龙虾 (LobsterAI),发布不到一月在 GitHub 获 4000+ Star,还获‘龙虾之父’点赞。有道 AI 应用架构师李良才在大会分享其养成史、架构选型及 Vibe Coding 实战。

AI科技大本营
新闻资讯7

黄仁勋曝英伟达养了61个CEO、从不炒犯错员工:CEO是最脆弱群体

黄仁勋在访谈表示英伟达有61个“CEO”,犯错不炒人,称CEO是公司最脆弱群体。他还谈及英伟达发展、用人哲学,预测五年后AI将改变计算机模式,增加工作机会,他本人不喜演讲但为公司尽力。

InfoQ
新闻资讯7

30余位产学研领袖确认出席!2025甲子引力嘉宾阵容第二弹|甲子引力

2025甲子引力年终盛典12月3日将在北京万达文华酒店举办,主题为“轰然成势,万象归一”。多位产学研领袖到场,设“应势而动”“识势而谋”“筑势而立”三大专场,探讨AI应用、投资及基座等产业趋势。

甲子光年
算法论文8

Diffusion约2倍无损加速!训练-推理协同的缓存学习框架来了| HKUST&北航&商汤

HKUST、北航与商汤提出HarmoniCa框架,解决Diffusion模型推理慢、成本高问题。它通过SDT和IEPO机制,解决训练 - 推理脱节,在多模型上实现推理提速、质量提升,且训练推理开销低,已开源。

量子位
算法论文8

ACL 2025 | 让小说角色 「活」起来!复旦BookWorld打造沉浸式小说世界模拟系统

复旦大学团队主导的BookWorld系统,是ACL 2025论文成果。它能从小说提取数据构建AI世界,让角色AI互动创作故事。系统有自主和干预模式,实验表现出色,未来可成互动娱乐平台。

机器之心