「工作方式革命」共找到 1819 篇相关文章
RAG外部检索是多余的,英伟达最新成果颠覆认知
英伟达INTRA论文指出RAG架构中检索器和生成器在不同表示空间工作,存在retriever - generator mismatch问题。INTRA让模型用注意力查询检索自身编码表示,训练量小,在多跳QA上超越多种检索基线。
Claude Code发布Agent View,多任务流的ADHD患者有救了
Claude Code发布Agent View,它像给Claude Code的tmux,能将多个Claude会话状态分类展示,帮用户分配注意力。它把Anthropic内部工作流产品化,有会话与窗口解绑、工作树隔离等设计。
北大校友Lilian Weng出镜,爆出120亿估值首个交互模型!
北大校友Lilian Weng出镜介绍Thinking Machines的交互模型,此模型200毫秒神同步,能感知协作。该公司此前获20亿美元种子轮融资,估值达120亿美元。模型打破传统交互局限,或改变人机互动方式。
DeepSeek视觉原语论文:当所有人在堆图像分辨率时,它在堆「指代精度」!
4月30日DeepSeek发布多模态论文,核心是“视觉原语”,让模型边推理边输出坐标。它是七大coding agent玩家中最后接入视觉的,但补课方式反共识,不堆分辨率堆指代精度,效率高,拓扑推理成绩领先。
终结多智能体视觉幻觉“滚雪球”!新国立等提出ViF:无需改造模型,即插即用
多智能体协同做视觉任务常轮次越多错得越离谱,根源是信息传递方式有缺陷。新国立等研究人员提出轻量通用的ViF范式,无需改造基座模型,可大幅压制幻觉滚雪球,已入选ICLR 2026。
5.2万Star项目被迫出走GitHub,但开源世界只剩更差的选择
Ghostty 项目创始人 Mitchell Hashimoto 宣布项目将逃离 GitHub,因其频繁故障影响工作。开发者群体对 GitHub 现状失望,认为平台重心转向 AI 产品致基础设施变差。但 GitHub 外的开源替代方案都有明显缺陷。
罗福莉:Claude订阅封杀龙虾背后,真正的出路不是更便宜的token
Anthropic宣布Claude Pro和Max订阅用户不得将额度用于第三方Agent框架,引发各方反应。Xiaomi MiMo大模型负责人罗福莉指出,当前token计费模式难应对挑战,需更优算力使用方式,还介绍了小米MiMo Token Plan。
谷歌的DeepSeek时刻:LLM推理加速被干到了8倍
谷歌TurboQuant论文介绍量化算法,能为大语言模型和向量搜索引擎大规模压缩。可将大语言模型KV缓存内存减至少6倍、加速达8倍且精度零损失,还介绍其工作原理及实验结果。
深入理解OpenClaw技术架构与实现原理(下)
文章为《深入理解OpenClaw技术架构与实现原理(下)》,讲解各系统模块,如SandBox沙箱系统、记忆管理等,还介绍自进化、工作区与路由等机制,最后展望企业级智能体架构和应用方向演进。
GEAClaw 来了:企业级“OpenClaw”,一只有商业头脑的龙虾
文章指出当前大语言模型解决问题多为收敛式,与商业问题需先发散再收敛的方式相悖。特赞发布企业级智能体系统GEA,其架构四层分工明确,能在市场洞察、社媒增长等场景发挥作用。