「人在回路」共找到 8824 篇相关文章
梁文锋执笔的R1论文登上Nature封面!首次回应外界三大质疑
9月17日,DeepSeek创始人梁文锋通讯作者名义发表的DeepSeek - R1论文登《自然》封面。该模型借助强化学习自主形成推理能力,在Hugging Face下载量破1090万次。新版论文回应质疑,披露训练细节,虽有不足但引发学界关注。
英伟达的局:狂撒15亿美元,从Lambda那租到了搭载自家AI芯片的GPU服务器
据The Information消息,英伟达与小型云服务提供商Lambda达成15亿美元合作,租赁其搭载自研AI芯片的GPU服务器。这并非首次,此前已对CoreWeave如此操作。目的是维护其在云计算市场的主导地位。
让AI作画自己纠错!随机丢模块就能提升生成质量,告别塑料感废片
来自清华、阿里等的团队推出S² - Guidance方法,通过随机丢弃网络模块动态构建子网络实现自我修正。它避免了其他方法繁琐调参,在文生图和文生视频任务中显著提升生成质量与连贯性,且计算高效。
一文看懂“存算一体”
文章介绍存算一体概念,它因传统冯·诺伊曼架构在数据爆炸、AI崛起下暴露“存储墙”“功耗墙”问题而提出。阐述其发展历程、技术路线、存储介质、应用场景,也指出技术、生态、市场方面挑战,前景潜力大。
字节&MAP重塑大模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限
强化学习虽提升大语言模型表现,但面临探索难题。字节跳动等团队提出FR3E框架,分两阶段重建探索机制,在多数学推理基准实验中显著优于强基线,为大模型强化学习提供新范式。
超越人类标注,Meta提出CoT-Self-Instruct:如何用"推理式自进化"重塑LLM训练
大语言模型发展需海量高质量训练数据,传统人工标注困境重重,现有合成数据方法也有缺陷。Meta提出CoT - Self - Instruct,通过推理式自进化生成数据,实验证明其在多个任务上超越人类标注数据。
从OpenAI离职创业到估值1700亿美元,Anthropic用4年时间引硅谷巨头疯狂押注
最新消息,Claude背后公司Anthropic即将达成新一轮融资50亿美元,总估值达1700亿,不到半年估值涨近3倍。该公司由前OpenAI员工创立,获亚马逊、谷歌等投资,其模型在代码生成领域优势明显。
月之暗面硬刚Anthropic!开源万亿参数Kimi K2,Agent编码性能直逼闭源最强!
上周五月之暗面发布并开源万亿参数Kimi K2,外网评价高。它或开启开源AI的“Agentic时代”,在智能体和编码基准上表现出色,成本远低于竞品,但推理速度较慢,已可平替Claude。
刚刚,为对抗哥大退学生开发的AI作弊器,哥大学生造了个AI照妖镜
Cluely是款备受争议的AI桌面助手,能替人参会。哥伦比亚大学学生开发反Cluely工具Truely,检测通话是否为真人。其原理是检测对方设备PID,不过使用较繁琐。同时,Cluely起诉公布其提示词的人。
微信支付这波操作把我干懵了,Agent能赚钱?
微信支付从商业底层——支付——直接 mcp 了,用户可在腾讯元器体验其 mcp 服务,支付后智能体干活。微信支付 MCP 让 AI 与支付系统融合,实现“对话即交易”,但也面临安全合规问题。