「大模型开源」共找到 10276 篇相关文章

产品应用8

一个重要的发布被忽略!Decart发布实时“Sora”,直播/游戏业迎来新变革

Decart推出全球首个实时、无限长度的AI视频模型MirageLSD,基于独创的“实时流扩散”技术。其响应时间低于40毫秒,攻克了“错误累积”和实现实时响应两大难题,还计划拓展应用及升级功能。

AI工程化
算法论文8

SIGIR 2025 | 解决扩展和迁移难题,华为新加坡提出InstructRAG,提升高达19%

大语言模型任务规划面临可扩展性和可迁移性挑战,华为新加坡团队提出 InstructRAG 方案,通过多智能体协同架构实现指令图扩展与少样本任务迁移,在多数据集测试中性能提升高达 19.2%。

机器之心
推荐文章7

Claude: 可视化

文章指出早期人与人靠体力拉开差距,工业革命后比拼脑力,AI 时代脑力被大模型拿走,人将比较心力。面对 AI 生成的海量文本,可视化或为解决脑力理解带宽瓶颈的解药,还给出了相关 Prompt。

李继刚
新闻资讯8

Karpathy最新开喷:一句话让全场Agent开发者安静了

Andrej Karpathy在面向Agent开发者的分享中称,当前AI最大错误是急着逼Agent干活,没先搞明白底层大模型。他结合自身经历给出三步忠告,还建议从神经科学找灵感,鼓励开发者。

新智元
8

Claude Code 之父的自白:非科班、辍学,却要革程序员的命

Claude Code创建者Boris Cherny做客访谈,回溯从Meta转至Anthropic的动机,称大模型是新生命形态,影响会重塑社会。还谈及Claude Code发展,从不好用到成主力,揭示软件工程正经历结构性重写。

InfoQ
开源动态8

DeepSeek在Agent上做了件大事!

昨天DeepSeek发布V3.2正式版,强化Agent能力并融入思考推理,其在Agent评测达开源模型最高水平。文中分析Agent成开源‘心病’的痛点,介绍DeepSeek相关解决策略及成果,还给出使用示例。

PaperAgent
开源动态8

Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍

Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优点,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理、模型个性化等场景。

AI寒武纪
产品应用8

腾讯王者归来:混元图像3.0登顶LMArena!一手实测全球最强图像AI

LMArena最新榜单显示,腾讯「混元图像3.0」在文生图任务中夺冠,碾压谷歌Nano banana和字节Seedream 4。它9月28日开源,性能对标闭源模型,有强大推理、语义理解能力,支持中英文长文本渲染。

新智元
新闻资讯7

清华辍学、斯坦福睡地板,华人小哥用AI社交挑战Meta,融资数千万美元

来自中国的小哥Brandon Chen打造AI原生即时通讯工具Intent,已获数千万美元融资。它结合微信聊天与大模型自动执行功能,如处理图片、规划旅行、生成购物清单等,带来全新聊天体验。

机器之心
推荐文章8

对「学习」的一切认知都错了

曾被认为不可能的超大模型如今成功驱动ChatGPT等,改变了对学习的理解。彩票假说解释其成功:大网络有中奖子网,能提供更多找简单解的机会,调和了经验与经典理论。

AI寒武纪