「系统2慢思考」共找到 3929 篇相关文章
揭示扩散语言模型扩展定律,人大高瓴团队与蚂蚁集团发布LLaDA MoE v2
中国人民大学高瓴人工智能学院与蚂蚁集团合作,首次系统刻画混合专家扩散语言模型扩展定律,据此训练LLaDA MoE v2,实现扩展效率与智能双重突破,将推动其迈向规模化时代。
登上 GitHub 日榜 TOP5,收获 1.2 万标星的自动剪辑视频开源工具。
video-use是browser-use团队开源的自动剪视频项目,登上GitHub日榜TOP5、获1.2万标星。它改变剪辑交互方式,让用户描述意图,有智能剪辑、调色等功能。技术亮点是双层读取系统,成本和效率更优。
GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了
OpenAI发布GPT - 5.2「全家桶」,含即时、思考、专业三款模型。它全方位碾压谷歌Gemini 3 Pro,在多方面进化,虽价格涨40%,但性价比更高,还适合多种专业工作,甚至能辅助科研。
Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距
Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。
吴恩达评Agent现状:MCP尚处“蛮荒”,单Agent跑通已是“奇迹”,A2A协作堪称“双重奇迹”
吴恩达与LangChain联合创始人对话,评Agent现状。他认为MCP尚处‘蛮荒’,单Agent跑通不易,A2A协作更难。还谈了Agentic架构、AI系统构建、工具使用、语音技术等,给出创业建议。
DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2
昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。
全球爆红后,Clawdbot之父2小时深度专访:退休3年后我杀回江湖
新智元对Clawdbot之父Peter Steinberger进行近2小时专访。他分享AI编程工作流,如一天600个Commit、让AI验证代码、用多个Agent并行开发。他还讲述经历,认为AI时代程序员要关注系统架构,强调与AI融合。
看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了
Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。
定义RAG新基准?谷歌发布 Gemini Embedding 2:首个原生多模态嵌入模型,延迟骤降70%
谷歌昨夜推出首个基于 Gemini 架构的原生多模态嵌入模型 Gemini Embedding 2,通过 Gemini API 和 Vertex AI 向开发者公开预览。它可将多类型数据映射到统一嵌入空间,多项基测排名第一,还获早期合作伙伴高度评价。
AI 编码 3.0:人机协作,正在走向多 Agent 协作系统化
文章指出AI编码正从2.0走向3.0,2.0解决生成问题,3.0则是执行系统。当Agent进入软件交付流程,协作需从经验驱动转向模型驱动,Kanban和Harness等工具也有了新角色,系统更强调验证和控制。