泛能网」共找到 5170 篇相关文章

产品应用7

真·养虾!3步让龙虾边聊边进化,不用GPU不用数据集就强化学习

程序员给智体套在线强化学习系统MetaClaw,把用户与AI对话变训练数据。它基于Kimi - 2.5,用SkillRL框架,不依赖本地GPU,训练交Tinker云平台,三步即可上手。

量子位
算法论文8

「Thinking with Images」推理速度太慢?「Zooming without Zooming」 让AI不调用工具也「明察秋毫」!

上海交通大学与蚂蚁集团联合团队发布多模态大模型成果“Zooming without Zooming”。该研究提出R2I方法,将“缩放”转为训练目标,使模型单次前向传播实现细粒度感知,团队开源的ZwZ模型家族达开源SOTA性

AI科技评论
新闻资讯7

18岁OpenClaw版AI女友一夜爆红,全60万围观!00后开发者一人造出

基于OpenClaw打造的韩国AI女友Clawra上线爆火,60多万人围观。她有完整人设,亮点诸多,项目还开源。此外,还有Aniclaw等类似项目,OpenClaw掀起热潮,智体生态蓬勃发展。

新智元
产品应用7

Claude Code 更长更快!Agent自己管项目了!从 Todo 升级到 Task

上周Claude Code团队更新任务清单系统,从「记事本」升级为「项目管理系统」。因模型力增强,需求变复杂,原TodoWrite无法满足,新Task系统解决了任务依赖协调问题,支持复杂项目。

AI产品自由
推荐文章7

Skills火爆之后,我收集并整理了最近全火爆的Skills,拿走不谢~~~

文章介绍 Agent Skills,称其是 AI 助理的「使用指南」,技分浏览、加载、使用三阶段加载,有快且轻、跨平台、易分享等优势。还推荐多个优秀 skills 及相关工具站,提醒从业务出发看待它。

小华同学ai
开源动态8

把RoPE扔掉,AI更看懂长上下文!Transformer作者团队开源大模型预训练新方法

Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。

量子位
产品应用8

国产芯片也跑AI视频实时生成了,商汤Seko 2.0揭秘幕后黑科技

自Sora 2发布,科技厂商掀起视频生成模型竞赛。12月15日商汤上线Seko 2.0,实现AI短剧‘一人剧组’。其背后的LightX2V框架做到实时生成,还适配国产芯片,有望推动视频创作生产力革命。

机器之心
开源动态8

英伟达4段简短提示词,IOI夺金!开源模型也征服最难编程竞赛

英伟达研究者提出GenCluster框架提升开源LLM解题力,让开源模型gpt - oss - 120b在IOI 2025获金牌级别高分。它执行‘海选+筛选+比拼+提交’流程,优势明显,标志开源AI里程碑式突破。

新智元
算法论文7

Qwen3 变身扩散语言模型?不从零训练也跑,30B参数创纪录

扩散语言模型(DLM)潜力大但训练难,Radical Numerics团队改造Qwen3-30BA3B,推出30B参数的开源扩散语言模型RND1-Base。该研究系统性研究A2D转换关键因素,成果超现有部分模型,还提出简单方法及训练策略。

机器之心
新闻资讯8

GPT-5来了!人人都免费用,最强大模型只需最傻瓜式使用

全世界等了2年,GPT - 5正式发布,面向所有人免费开放。它在AIME 2025取得优异成绩,编程等方面全面提升,集成多模态和推理力,还推出多种使用模式和API模型,不过也遭马斯克等质疑。

量子位