「长思维链SFT」共找到 954 篇相关文章
想实现AGI,得先建好“AI工厂”
人工智能算力需求膨胀,行业陷入‘暴力美学’迷思。摩尔线程在2025 WAIC前夕提出‘AI工厂’理念,解构其‘五要素’,并展示多领域应用案例,为算力建设提供系统性解法。
深度解读《AI 智能体的上下文工程》:构建高效 Agent 的七个宝贵教训
作者解读 Manus 团队文章,结合自身理解总结出构建高效 Agent 的 7 个关键点,如依赖上下文工程、提升 Prompt 缓存命中率等,还给出总结与核心启示,对 Agent 开发有借鉴意义。
倒反天罡:ChatGPT教人说话?36万视频+77万播客已证实!
最新研究警告,ChatGPT正改变英语表达方式,植入自身偏好。研究人员分析超36万视频和77万播客,发现GPT词汇使用率显著攀升。但研究有局限,且AI沟通还引发信任危机等问题。
OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型
音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。
火速吃瓜,OpenAI模型还没发又惹出争议了??
GPT - 6发布前夕消息不断,OpenAI新模型引入的“循环深度”技术因可能让模型思考难监控引争议,同时模型名或被API剧透,图像模型GPT Images 2.1也将更新。
这个周末,很多人都在等一个额度重置,以及对 Work 模式的吐槽
ChatGPT Work 模式上线后,Token 消耗快,用户等额度重置。该模式与 Codex 易混淆,前者处理通用知识类长任务,后者面向软件开发。国内外产品纷纷推 Work 模式,未来或融合。
突发!你关注的AI博主被「焦点访谈」报道了!
AI博主花叔上了央视《焦点访谈》,他曾靠AI coding能力做出付费榜第一的App。时隔一年多再次被报道,他认为是时代需要这个故事。此外,他的开源项目「女娲.skll」已突破20000+stars。
Anthropic说:Session Management 是最好用的 Harness Engineering!
Anthropic指出管理Session、Context等在Claude Code上已落地。模型上下文并非越长越好,rewind比纠错好,compact要把握时机,subagent可隔离上下文,如今行业看重agent产品runtime。
视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26
多镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为多镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。
西湖大学王东林团队论文:机器人需要“通古今,知未来”丨CVPR 2026
西湖大学王东林团队提出论文《HiF-VLA:Hindsight, Insight and Foresight for Vision-Language-Action Models》,介绍HiF-VLA模型,它以“运动”表达时间信息,实现稳定连续决策,性能提升且计算成本低,推动机器人从“看到就做”到“边想边做”。