「上下文去噪训练」共找到 2911 篇相关文章
狂涨 36.9K star!!看看人家的开源微信机器人多优雅,微信、飞书、钉钉支持,效率飙升!
开源君介绍超火的开源项目`chatgpt-on-wechat`(CoW),它结合大模型与社交、办公平台,可定制优化。能接入多平台,支持多模型,处理多模态消息,有丰富插件,还能记忆会话、定制知识库。给出安装步骤。
Science:AI预测教皇选举翻车!新教皇缘何成「意外之选」?
梵蒂冈宣布美国红衣主教Robert Prevost当选新教皇,而AI预测的是意大利红衣主教Pietro Parolin,Prevost不在预测名单。研究人员用算法分析选举人,还请ChatGPT整理资料,专家指出模型有局限但方法或可用于其他选举。
豆包工作体验:Agent 正在成为工作的新入口
豆包发布“豆包工作”,定位为独立办公 Agent 工作台。体验良好,能开项目、连办公应用。文章指出用户习惯迁移,Agent 成工作入口,还探讨了办公 Agent 的竞争点、权限问题、组织提效及人员角色转变等。
“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户
围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。
专访|两位华人主导创办,Jeff Dean参投,伯克利开源项目SkyPilot转型初创
前沿模型团队算力瓶颈从不足变为分散,开源AI算力调度项目SkyPilot应运而生。7月末,它从高校走出成为初创公司,完成2000万美元种子轮融资。其免费版与商业版各有侧重,切入AI编排赛道潜力大。
刚刚,Anthropic新作:大模型意识被发现了
Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。
软件 3.0 时代来临
OpenAI 联合创始人 Karpathy 在 AI Ascent 2026 大会提出软件正经历第三次范式转移。从 Software 1.0 到 3.0,人类参与编程方式不断变化,3.0 用自然语言编程,中间层应用被模型原生能力吞噬。
LangFlow: 挑战离散扩散,探索下一代语言模型新范式
UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。
字节、阶跃之后,张心皓押注Human Loop:Agent Loop赢家通吃,创业要走另一条路
张心皓曾在字节跳动工作10年,后创业,现做Jovida,目标是“从愿望到行动零摩擦”。他认为Claude Code定义纯Agent Loop上限,创业应做Agent in Human Loop,还分享了产品理念、架构、商业化等看法。
Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度零损失
Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度零损失,解决了传统算法的压缩开销问题。