「AI 模型构建」共找到 13780 篇相关文章
Node.js之父宣判“手写代码时代结束”!DHH明确反对“结束论”:大模型还差口气,手写更有竞争力
Node.js之父Ryan Dahl宣称人类写代码时代结束,而Ruby on Rails作者DHH反对,认为大模型还差口气,手写代码仍有竞争力。DHH分享AI使用体验,指出距AI带来明显优势的拐点还差一点,还探讨互联网和产品发布等问题。
阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了
阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。
“AI版LeCun”自己讲解论文,自我进化智能体框架生成精美演讲视频
加州大学研究者提出自我进化的学术演讲智能体框架EvoPresent,它由四个智能体协作,核心美学模型PresAesth模拟人类审美判断。团队构建评测体系,实验显示其在内容与视觉设计上提升显著,让AI兼顾逻辑与美感。
英伟达为机器人推出懂推理的“大脑”!升级版Cosmos世界模型来了
在SIGGRAPH大会上,英伟达推出全新升级的Cosmos世界模型,重点升级规划能力与生成速度。还升级配套软硬件,如Omniverse库等。英伟达全力布局机器人领域,认为图形与AI融合将变革该领域。
18个月月收33万刀!起底“AI套壳”生意经:是昙花一现还是隐形金矿?
文章探讨AI套壳生意,指出开发者调用现成API做应用,这类应用有昙花一现的,也有长成产品的。套壳应用面临模型访问权和分发渠道两大挑战,但利基市场有机会,成功产品需有结果主导权和专有数据。
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。
Shopify分享了他们做Agent的万字踩坑经验
Shopify分享构建生产级AI助手Sidekick的万字经验。构建中遇工具拓展难题,用JIT指令解决;评估是大挑战,建立严谨体系,虽有提升但效果仍有波动,模型还会钻空子,最后强调单Agent系统也强大。
Builder.ai 破产背后:700 名工程师伪造 AI 是假,重复造轮子及财务造假是真
印度AI独角兽Builder.ai破产引发关注,此前有说法称其用700名工程师伪造AI。经与前员工沟通,这一说法不实。该公司搭建了AI工具Natasha,技术栈含Python、GPT等,但存在重复造轮子、财务欺诈等问题致破产。
750城市+5000小时第一人称视频,上海AI Lab开源面向世界探索高质量视频数据集
上海人工智能实验室等机构联合推出持续迭代的高质量视频数据集项目Sekai,含Sekai-Real和Sekai-Game两个数据集,还训练了模型Yume。它特点突出,团队按四环节构建,望成世界建模等领域的数据基石。
当达沃斯还在热议AI未来时,中国一家公司的AI教育已经服务了全球5000万群体
世界经济论坛第56届达沃斯年会聚焦AI,各方探讨其走向与价值。松鼠Ai作为中国AI独角兽企业受邀,其智适应教学系统落地应用,创始人栗浩洋提出AI价值重构,该企业还具备全球复制潜力。