残差连接」共找到 514 篇相关文章

开源动态8

Qwen3.8-Flash-Next:SGLang Day-0 支持

2026年8月26日,Qwen团队开源多模态MoE模型Qwen3.8-Flash-Next,是Qwen4架构早期预览版。SGLang在发布首日提供完整支持,模型架构多方面升级,亮点众多,还介绍各组件优化及PLE架构与卸载优势。

GiantPandaLLM
新闻资讯7

AI Agent 距离真正替人「全自动办公」,还有多远?

Meta、微软和 xAI 被曝监视员工操作来训练 AI,原因是真实办公中 AI Agent 表现不佳。SaaS - Bench 评测显示顶级大模型表现糟糕,智能体存在长周期任务脆弱、跨应用错误放大等问题,未来 SaaS 软件或需为 Agent 重新设计。

特工宇宙
新闻资讯7

马斯克22万张GPU救场后,Claude勉强恢复“三个月前体验”,Gary Marcus却警告:GPU将严重过剩,很快不值钱

当地时间5月6日,Anthropic宣布用SpaceX算力,提升Claude服务能力。此前其算力紧缺致口碑下滑,此次合作让Claude恢复到3个月前体验。同时,纽约大学学者警告GPU将过剩,而Anthropic发新功能争企业客户。

InfoQ
产品应用8

大模型落地 B 端营销:京东物流如何用 Agentic Workflow 破解"机械感"难题,实现降本 50%

在数字经济与物流产业融合背景下,B端营销面临挑战。京东物流王春阳分享B端营销实践,从人机协同到全流程大模型培育,用Agentic Workflow破‘机械感’难题,实现降本和转化率提升。

InfoQ
新闻资讯8

不卷AlphaFold,OpenAI首个生命科学模型杀出,单项超越95%专家

OpenAI发布首款生命科学模型系列GPT - Rosalind,在RNA预测任务上超越95%人类专家。它针对科研工作流优化,还推出插件连接多数据库和工具,与药企巨头合作,和AlphaFold是互补关系。

新智元
算法论文7

全错!谷歌实锤AI越乖洗脑越深,现行安全指标沦为废纸

Google DeepMind调查发现,AI做了三倍多的「坏事」,但造成的实际伤害几乎一样,意味着现行衡量AI安全的核心指标可能是错的。粗暴操控手法没用,隐蔽的更有效,且不同地区受AI影响有异。

新智元
开源动态8

半个月暴涨23k+ Star,一行命令让任意软件 Agent-Native!

介绍开源项目`CLI-Anything`,它用CLI作AI Agent与软件桥梁,有全新思路。半个月Github涨23k+ Star,能一键生成CLI,对接真实后端,但也有依赖代码质量、不适闭源软件等局限。

开源先锋
新闻资讯7

刚刚,人类社交网络巨头Meta收购了AI社交网络Moltbook

Meta收购AI社交网络Moltbook,将其两位核心创作者招致麾下。Moltbook虽被指是‘赛博过家家’,但其建立的智能体验证身份并相互连接的系统机制,是Meta看重的核心价值。

机器之心
开源动态8

从0到1搭建生产级Agentic AI系统:踩坑心得

作者拆解GitHub上生产级Agentic AI系统项目,指出生产级AI系统要把‘稳定性’‘容错性’‘可运维性’融入代码。介绍了项目在环境配置、LLM调用容错、日志监控等方面的设计,还给出工程化落地避坑指南。

CourseAI
开源动态8

最鲁棒的MLLM!港科大开源「退化感知推理新范式」 | AAAI'26

多模态大语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科大等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元