国科大」共找到 5098 篇相关文章

新闻资讯7

硅谷顶级团队闭门会,让Agent活下来的共识,95%的AI Agent都死了

旧金山AI技术会上,企业佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。

探索AGI
新闻资讯7

当AI Agent遇到资本,为什么Genspark 能突出重围

文章讲述Genspark在AI Agent赛道的发展。它由景鲲创立,从AI搜索转向Agent,虽人气略逊Manus,但通过制造话题、快速迭代产品、合理团队构成突出重围,估值达12.5亿美元,还探讨了Agent公司被厂收购的可能。

AI科技评论
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen
新闻资讯8

一个上海AI独角兽爆发了

全球AI圈因MiniMax“发布周”沸腾。新模型MiniMax - M1被视为“性价比新王”,还有新视频、语音模型表现出色。其89年博士闫俊杰带队,在模型研发上多次做非共识选择,现估值超30亿美元,还推出智能体产品。

芯师爷
开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布新成果,开源轻量级语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
新闻资讯8

a16z 合伙人:AI 正将 10 倍工程师“降级”为 2 倍!应用层已无技术护城河,未来在基础设施和业务深耕

Andreessen Horowitz (a16z) 的合伙人 Martin Casado 在对话中指出,当前AI模型竞争格局似当年云计算战,寡头垄断将降临。他还谈到AI对开发者、投资决策、市场格局的影响,以及对AI安全、开源等问题的看法。

AI科技大本营
7

【博客转载】CUDA Vectorized Memory Access (文末送书)

文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、小及方法的性能,得出拷贝数据单元多、单元及以8或16字节向量化单元拷贝可提升带宽等结论。

GiantPandaLLM
新闻资讯7

硅谷祛眼袋,海淀求嫩肤:中外科技老哥都在偷偷卷颜值

加州整形外科医生爆料,过去五年科技圈男性做医美的多了五倍,对拉皮等开刀项目也趋之若鹜。国内科技厂周边医美机构男性客户也增多,多以轻医美为主。科技从业者医美需求飙升,与年龄焦虑和找对象需求有关。

量子位
开源动态8

「具身原生」元年!专访原力灵机汪天才,解析具身智能的「PyTorch时刻」

2月10日原力灵机发布开源具身原生框架Dexbotic 2.0,宣布与RLinf合作。合伙人汪天才将其与RLinf结合定义为具身智能的「PyTorch时刻」。还推出具身模型DM0和应用量产工作流DFOL,推动具身智能进入「具身原生」时代。

机器之心