「维苏威挑战赛」共找到 1111 篇相关文章
阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型
LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。
ICLR 2025 Oral | LLM也有从众心理!
浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。
TreeHop:无需LLM的高效多跳问答新范式
多跳问答(MHQA)任务有挑战,现有方法依赖LLM,计算成本高、延迟显著。TreeHop研究提出新方案,摒弃LLM,通过嵌入空间动态更新,降低延迟、减少模型参数量,还在主流数据集表现佳,适合工业应用。
AI无师自通,搞定所有家务!π0.5突破泛化极限,UC伯克利系出品
具身智能最大挑战是泛化能力,美国具身智能公司Physical Intelligence推出π0.5 VLA模型,通过异构任务协同训练实现泛化,可在全新家中执行各种家务,虽有不足但向广泛泛化物理智能迈进。
构建一个 Agent 只要三分钟,但为什么大多数企业的 Agent 还停留在 Demo 阶段?
文章以 Google Cloud 开发者大会演示引出问题:构建 Agent 仅需几分钟,为何多数企业的 Agent 还停留在 Demo 阶段?指出这背后是治理、运行时等一连串工程挑战的叠加,还介绍了 Google Cloud 相关解决方案。
Harness Engineering:耗时一周,我是如何将应用的AI Coding率提升至90%的
文章结合Anthropic、OpenAI方法论与项目实践,分享为存量Java应用构建Harness体系,将AI代码率从不到25%提至90%的方法。介绍Harness概念、现状挑战、实战步骤、关键经验及效果,还对其未来发展做了展望。
王兴兴亲测后点赞!这家AI公司提前半年把“龙虾”能力带上车,还管住了Token黑洞
宇树科技王兴兴体验宝马新世代 i3 智能座舱后称赞,其核心技术来自斑马智能“元神 AI”。斑马智能发布“元神 AI 汽车机器人大脑”等,对“元神 AI”升级,明确交流和办事方向,还管控 Token 等挑战。
谷歌TPU能撼动英伟达吗?前TPU工程师首次揭秘
在AI算力争霸时代,英伟达GPU市值狂飙,但蛋糕正被分食。前谷歌TPU工程师Henry揭秘TPU,从架构、产能、软件等维度分析其优缺点,指出在特定条件下TPU可挑战GPU,未来芯片市场将百花齐放。
两月蒸发1.6万亿:SaaS 被AI「杀死」了吗? | GAIR 025
今年初,北美软件股两月蒸发超1.6万亿美元,引发对SaaS未来的担忧。雷峰网圆桌中,何润、Daniel、吴昊三位行业老兵探讨现状与未来,认为AI冲击下,SaaS虽面临挑战,但不会被杀死,正全面转型。
AI产品用户留存仅三个月周期?对话王咏刚:“不和AI协作过项目,你就不是合格程序员” | 万有引力
CSDN&《新程序员》总编对话Mootion创始人王咏刚,探讨AI时代程序员、创业者面临的机遇与挑战。王咏刚认为AI上限是人类平均水平,目前AI应用多为尝鲜用户,产品留存短,未来程序员需与AI协作。