「快思考」共找到 1439 篇相关文章
1700亿美元估值!Anthropic融资50亿,AI独角兽争霸战进入新阶段
Anthropic拟融资30 - 50亿美元,估值达1700亿美元,或成全球估值最高未上市AI公司之一。它由前OpenAI成员创立,聚焦AI安全。核心产品Claude有独特优势,与GPT - 5各有千秋。其商业化侧重企业,虽增长快但亏损大,业内对估值看法不一。
苹果不吹 AI,反而成功了?
北京时间9月10日苹果发布会,与iPhone 16发布时大肆宣传AI不同,此次重点在硬件及AI幕后支持。此前苹果对AI宣传过度致部分功能未推出引失望,且在智能体AI助手进展落后。多数人不因AI换机,给了苹果试错时间,但它在AI竞赛中落后,中国厂商布局更快。
林俊旸果然创业了!一个“Qwen负责人”头衔值135亿
前阿里千问大模型负责人林俊旸离职后创业,种子轮目标估值20亿美元。他曾深度参与阿里多个大模型项目,离职首篇长文提出“Agentic Thinking”,或为创业方向。
突破40年Dijkstra算法瓶颈,清华教授等颠覆教科书!斩获STOC最佳论文
清华大学教授段然提出最短路径新方法,击败经典Dijkstra算法,突破40年排序瓶颈。该算法不依赖排序,运行更快,摘得STOC最佳论文,团队正优化追求更快速度。
基于Agent的SGLang Diffusion Kernel优化实践:Qwen-Image、FLUX.2和视频模型
本文记录基于Agent完成Qwen-Image、FLUX.2、Wan和SANA Video优化的过程,包括定位问题、写Kernel及遇到的坑。介绍SGLang Diffusion Kernel结构,分析数值敏感原因,展示各模型优化实践、无收益实验及验证流程。
3.4K星Apple出品FastVLM:视觉TTFT效率提升85倍,凭啥这么牛!
文章指出VLM在实际生产应用中因高分辨率图像存在效率问题,介绍Apple出品的FastVLM解决方案,阐述其架构、训练过程,展示在多个基准测试的性能,凸显在高分辨率输入下提升效率的优势及实际应用价值。
AI提效20%,我们程序员加班却越来越狠:老板量生产力的尺子,歪了?
文章指出 AI 虽提升编码效率,但整体提效有限,企业衡量开发者生产力的指标易走偏。不同行业对 AI 应用态度不同,企业需合理管理 AI 成本,未来人的价值体现在复杂工作中。
多模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案
上海人工智能实验室等团队提出全新生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。
攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0
9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。
长视频生成可以回头看了!牛津提出「记忆增稳」,速度提升12倍
牛津大学团队提出VMem,把「看过什么」写进几何小片,用基于3D几何的记忆索引替代短窗上下文,实现「一致性更强、资源更省、速度更快」,实测速度比常规管线快约12倍。