开发栈」共找到 1839 篇相关文章

开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为大模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
7

AI越来越强大,如果客户都去自研了,那企业软件市场会怎么样?

AI能力变强、门槛降低,引发企业软件开发是否会被颠覆的讨论。企业不会自建核心系统,因要专注核心业务且不想承担维护等成本。真正威胁是用AI重新设计产品的同行,技术更替规律下传统SaaS公司需警惕。

AI工程化
新闻资讯7

十周前才写下第一行代码,如今颠覆 9 个行业?员工人均 10 万粉,00 后创业者狂言:我们将超越 OpenAI

本文聚焦 21 岁 00 后创业者 Roy Lee 和他的桌面 AI 助手 Cluely。该产品获高额融资、估值达 1.2 亿美元且已盈利,但也饱受争议。文中还揭秘其成功热度的关键、团队情况,探讨 AI 时代产品留存演变。

InfoQ
新闻资讯7

Devin CEO:别搞多智能体!Anthropic:我们性能提升90%!

最近,开发Devin的Cognition CEO发文称不要构建多智能体系统,而Anthropic分享构建多智能体研究系统,性能提升90%。Cognition认为多智能体协同难,坚持单线程线性Agent;Anthropic用工程设计绕开瓶颈。二者因任务类型不同观点有别。

探索AGI
新闻资讯7

Redis 之父:哪怕被喷我也得说,AI 远远落后于人类程序员!开发者跟评:用大模型气得我自己写代码都有劲儿了

Redis之父Antirez分享开发经历称人类程序员仍比大模型出色,举例说明在解决Redis复杂bug时,人类的创造力能想出奇特有效的解法,而大模型较难做到。开发者看法不一,有将其当助手,也有认为它会干扰思路。

InfoQ
产品应用8

逆天! Claude Opus几小时攻破C++大神4年死磕Bug

Reddit上有30多年C++开发经验的大神ShelZuuz,被一个困扰四年的Bug折磨,投入约200小时未解决。用Claude Opus几小时就找到症结,而此前GPT - 4.1等模型都失败。大神认为AI在编写新代码上像初级开发者。

AI寒武纪
新闻资讯7

承包了春晚的4家机器人企业,都什么来头?

今年春晚机器人表现亮眼,背后四家企业各有来头。银河通用王鹤专注具身多模态大模型;宇树科技王兴兴三次登上春晚,技术迭代快;松延动力姜哲源辍学创业,产品获订单;魔法原子吴长征有全自研能力,融资后欲冲击IPO。

芯师爷
算法论文8

小模型大作为!微博的VibeThinker-1.5B超越DeepSeek R1等头部大模型

近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发的VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。

深度学习自然语言处理
8

从一个公众号智能体说起:好用的Agent,究竟需要什么?

文章从公众号智能体切入,探讨好用的 Agent 所需条件。介绍腾讯云智能体开发平台 3.0,其有知识处理进化等能力;还提及 Agent 在酒店、营销等场景应用,强调可靠工程与用户触达对实现其价值的重要性。

机器之心
开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心