大模型开发」共找到 10160 篇相关文章

算法论文8

阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning

阿里与清华研究发现,训练语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理
开源动态8

告别“对讲机”时代:面壁智能给 AI 装上了“神经末梢”

2026 年初,OpenClaw 等开源项目让 Agent 概念爆火,但存在延迟、隐私等问题。面壁智能发布 9B 小模型 MiniCPM - o 4.5 和硬件开发板松果派,解决 AI 本地运行痛点,推动其从云端到端侧进化。

AI科技大本营
产品应用8

拓宽百年奥运「赛场边界」,阿里云AI让人人皆可上场

阿里云作为2026年米兰冬奥会官方云服务合作伙伴,联合发起全球AIGC赛,用万相模型生成冬奥视频参赛。万相Wan2.6性能出色,在画质、叙事等方面表现成熟,让普通人也能在奥运体验中当主角。

机器之心
推荐文章8

AI三问:Agent、LLM、RAG,一文厘清!

文章介绍语言模型(LLM)、检索增强生成(RAG)和AI智能体(Agent)三种架构。阐述其概念、工作原理、应用场景、优缺点,还做了横向对比,给出选用建议,最后提及混合架构与未来趋势。

MCP Lab
产品应用8

告别 AI 土味审美!Kimi K2.5 实测:扔个视频复刻 iOS 级丝滑动效

Kimi 上线 K2.5 模型,前端审美佳,接近 Gemini 3,增强多模态识别,支持视频。测试显示它能按要求生成漂亮网页,还可通过反馈迭代。它对设计师和普通人帮助,且 Agent 模式任务完成率高。

歸藏的AI工具箱
新闻资讯7

硅谷VC新玩法"Kingmaking":还没写代码也能拿到上千万投资

过去半年,三家未成型AI公司各获超5000万美元投资。如今VC采用“造王术”,在代码未写时就砸钱。因模型烧钱、头部效应强,投资人想用钱堆出“冠军”,这也给小团队带来机会。

AI工程化
开源动态8

MIRIX重塑AI多模态长期记忆:超Gemini 410%,节省99.9%内存,APP同步上线

UCSD和NYU团队推出开源的MIRIX,全球首个多模态、多智能体AI记忆系统。它表现亮眼,在多任务中超越传统方法,有类人记忆系统等特点,还上线Mac端应用,开启模型从对话生成到长期记忆驱动心智的新周期。

机器之心
产品应用8

“天下苦CUDA久矣!”KernelCAT率先掀桌,实现国产芯片无痛适配

中国AI产业与英伟达GPU及CUDA生态深度依赖,国产AI根基脆弱。KernelCAT作为AI Agent,能开发高性能算子,在昇腾芯片调优测试中表现出色,还能让国产模型在昇腾芯片上高效部署,实现35倍加速。

InfoQ
产品应用7

实测可灵O1,AI视频界的Banana也来了。

可灵推出全新多模态视频模型可灵O1,融合多种视频生成与修改能力。实测显示,它能实现视频内容增删、特定内容修改、扣绿幕、动作迁移、风格更改等功能,虽有局限,但开启用嘴改视频新时代。

数字生命卡兹克
新闻资讯7

1 亿美元 ARR、不设 AI 硬件产品经理,Plaud 如何拿下全球百万用户?

2023年6月Plaud AI推出AI录音卡片Plaud Note,一年多交付30万台、ARR达1亿美元,今年7月全球出货量达100万台。Plaud中国区CEO莫子皓称其更像模型公司,无真正对手,分享了产品观和招人标准等。

AI前线