「1.5B 模型」共找到 9269 篇相关文章
Cursor:AI编程「第三时代」来了
近日,Cursor CEO Michael Truell 称 AI 编程迈入「第三时代」,特征是 Agent 能在少人工干预下完成大规模任务。Cursor 核心转变,内部超 1/3 代码提交由云端智能体创建,团队预计多数开发工作将由其完成。
The Batch: 893 | 从预测到执行
2026 年 AI 研究应认识到能预测的模型不等同于能行动的系统。过去十年在被动预测和生成建模成就非凡,但现实任务需系统执行一系列动作。转向长周期任务和目标导向 AI 系统有两大好处。
还是谷歌懂程序员?Demis 采访首提“氛围编程”,Gemini 3 彻底戒掉“爹味”说教
谷歌连发产品,Gemini 3 余温未消又推出 Nano Banana Pro。Google DeepMind CEO Demis 与团队副总裁对话谈其细节,包括降低运行成本、调整“人设”、提出“氛围编程”,还认为 AGI 到来需 5 到 10 年及研究突破。
IMO怒斥OpenAI自封夺金,“91位评委均未参与评分”,网友:炒作无下限
OpenAI宣称新模型获IMO金牌不到24小时剧情反转,多位官方人士和大佬指其做法“粗鲁且不恰当”。其“金牌”成绩或站不住脚,未与官方合作,无评委参与评估。此事引发学术道德和商业炒作争论。
[Triton编程][基础]vLLM Triton Merge Attention States Kernel详解
文章详细介绍vLLM中Triton Merge Attention States Kernel的实现,与PyTorch原生实现对比,该Triton kernel最高可实现3 - 5倍以上算子加速。内容涵盖Merge Attention States概念、PyTorch实现、Triton基础算子、分析及性能评估等。
阿里的 AI IDE 登场了,这事绝对有戏
阿里云正式发布通义灵码的AI原生IDE:Lingma IDE,免费开放,核心功能和Cursor对齐且速度更快。其整合Qwen、DeepSeek系列模型,有感知引擎等亮点,还有企业版适合国内公司。AI编程竞争激烈,阿里有机会做成。
字节Seedance,正在占领好莱坞
字节Seedance从被好莱坞排斥到被认可,进入创作者圈与工作流,用于拍电影长片。它成本低且有免费福利,吸引独立电影人。在AI视频模型竞赛中逼近美国对手,影视业对AI投入将上涨。
为训推加速!全新FlashQLA注意力算子库开源
自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。
刚刚,机器人练成了宁次的「白眼」:∞帧画面边看边3D重建我们的世界!
蚂蚁灵波开源的LingBot - Map模型实现无尽流,可看∞帧视频稳定实时3D重建。它打破“既要实时、又要记路、还要省显存”的不可能三角,在多项测试中表现优异,补齐具身智能关键拼图。
小米AI语音新框架:人人都能当声音导演
小米大模型应用团队提出Midasheng - audio - generate与Xiaomi Any2Speech两大音频生成框架。前者可实现全场景声音重建,后者让AI学会理解声学空间与叙事逻辑,改变了语音合成应用场景与思路。