「新注意力机制」共找到 4310 篇相关文章
yann lecun(杨立昆)新公司AMI融资10亿美元,要做LLM的替代品
Yann LeCun离开Meta后与Alexandre LeBrun创立AMI Labs,获10.3亿美元融资。他们认为LLM有幻觉问题,AMI Labs用JEPA架构构建‘世界模型’,代码和论文将开源,不过短期内无产品和收入。
给龙虾定MBTI、发工牌,还让龙虾偷技能…打工人得适应新环境了
AI圈掀起“养龙虾”热潮,智谱、腾讯纷纷发布相关产品。极客和开发者对龙虾进行实测,它不仅能用于打造赛博宠物、线上办公室,还能完成视频剪辑、教辅、营销等工作。同时,Agent框架让大模型进入业务线,飞书成合适的工作台。
TypeScript 之父 Anders Hejlsberg:别折腾“AI新语言”了,真正变天是 IDE 让位给 Agent
TypeScript 之父 Anders Hejlsberg 在与 GitHub 研究顾问对谈中回应质疑,称选 Go 重写编译器合理。他认为 AI 编程时代,TypeScript 语言服务将重塑,IDE 或让位给 Agent,还谈到 AI 在代码迁移中的应用及开源可持续性问题。
11.77亿资本押注卡车新势力「一哥」,L2升维路线率先在商用车跑通!
2026年初,自动驾驶卡车新势力DeepWay深向完成11.77亿元Pre - IPO轮融资,国资、外资、产业资本齐参与。该公司靠卖新能源重卡营收可观,采用L2升维L4的战略,自研重卡与智驾技术成熟,其发展路径获资本看好。
拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式
使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。
谷歌也要「AI抖音」了!新Veo 3.1原生支持竖屏,4K分辨率高画质
谷歌Veo 3.1升级,全方位提升视频生成质量,新增竖屏和4K两大特性。它还提升创意、一致性和元素融合能力。谷歌借此进军AI短视频,结合自身优势推动“AI视频竖屏化”趋势。
港大联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型
香港大学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。
Anthropic重磅新研究:当AI采访了1250人,它看见了人类的「职业软肋」
Anthropic推出Interviewer工具,与1250名职场人、创作者、科学家深度对话,记录细节并量化。该工具能自动完成访谈、分析等流程,受访者满意度超97%。研究揭示不同职业对AI态度受职业结构等因素影响。
谷歌全线开挂!Gemini 3 Deep Think夺多项推理SOTA,Gemini亚洲新团队也官宣了
谷歌的Gemini 3 Deep Think模式正式上线,推理能力显著加强,在ARC - AGI、HLE等多项权威测评中夺魁,仅向Google AI Ultra订阅用户开放。同时,谷歌DeepMind将在新加坡成立新的Gemini研究团队,由95后华人科学家Yi Tay带队。此外,谷歌还推出了Google Workspace Studio。
AI为啥不懂物理世界?李飞飞、杨立昆:缺个「世界模型」,得学大脑新皮质工作
近来,杨立昆计划离开Meta创立以‘世界模型’为核心的AI公司;此前李飞飞也发文指出大语言模型弊端,强调建立‘世界模型’重要性。该模型源于对大语言模型局限的反思,能让AI理解物理世界。