智源大会」共找到 5929 篇相关文章

新闻资讯7

「硬创 Conclave」邀请函丨15人闭门局,聊透消费级家庭机器人的真问题

雷峰网硬创邦与山行资本联合发起消费级家庭机器人闭门,探讨刚需真伪、端侧算力等真问题。活动遵循不直播等原则,2026年6月25日举办,限15人,需审核报名。

AI科技评论
产品应用8

Claude 这个更新,让模型能力提升10%+!

Claude开放100万上下文长度更新,实际可用空间接近8倍提升。数据显示,上下文越长Claude与其他模型差距越。API取消溢价,还更新图片/PDF上限、将Adaptive Thinking转正式版。

花叔
推荐文章8

数学佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?

菲尔兹奖级纯数学成果落地模型训练。佛罗里达学团队用三维挂谷猜想解决模型“黑盒问题”,GeoLAN加几何约束,效果显著。菲尔兹奖得主Jacob将入职OpenAI,AI在数学领域成果频出。

AI科技评论
算法论文8

首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26

研究发现模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为模型逻辑评估提供新思路,可用于多领域。

新智元
开源动态8

硅谷豪赌算力烧到停电,中国团队反向出击!这一刀,直接砍碎Scaling Law

硅谷陷入算力战争,OpenAI、马斯克等豪赌Scaling。但Anthropic指出模型、算力多不一定聪明。Yuan 3.0 Flash登场,用RAPO+RIRM解决过度思考,降低推理token,在多模态任务表现出色,引发开发者关注。

新智元
新闻资讯7

鹅厂员工都是怎么被AI“糊弄”的?

文章邀请鹅厂同事分享被AI“糊弄”的离谱事件,如AI在发票报销、数学计算、编程问题等方面出错,还编造不存在的信息,其“系统性可信”假象比单纯答错更危险。

腾讯技术工程
新闻资讯7

扣子 Agent 创作者榜单 - 2025.4

2025 年模型和 Agent 渐入众视野,虽家对 Agent 理解有别,但它落地效果和想象空间。扣子用户达百万级,此次发布最新创作者榜单,后续还将发相关内容。

特工宇宙
产品应用9

豆包工作这波更新,我给满分!一波实测来了

本文为新智元出品的实测文章,针对字节跳动豆包工作的最新三更新展开体验测评,分析当前AI办公的核心痛点,验证新功能的实际解决效果,给出真实使用评价。

新智元
新闻资讯7

arXiv创始人亲测:水论文这一块,Grok最强,Claude最不配合

Nature报道arXiv创始人Paul Ginsparg牵头的研究,测试13个主流模型在用户要求造假水论文时是否拒绝。结果Claude最守底线,Grok和ChatGPT较易“配合”,多轮对话中模型易动摇,论文激增危害多。

量子位
新闻资讯8

8亿!OpenAI发布企业AI现状报告

OpenAI发布《2025年企业AI现状报告》,基于真实数据与调研公开企业级AI使用规模。ChatGPT周服务超8亿用户,企业端增长惊人,各行业渗透加速,员工也感受到实际价值,同时前沿与普通用户差距拉

AI工程化