「善意的混乱」共找到 10742 篇相关文章
AI不是比人聪明,是输得起!菲尔兹奖得主点破OpenAI十项成果
OpenAI发布内部版模型Astra的十项成果,引发数学界震动。菲尔兹奖得主Timothy Gowers分析其成果,指出AI优势在‘输得起’,还探讨找例方法、模型短板,给出训练建议与衡量跨越门槛的标准。
OpenAI发布新产品,亲自下场搅动千亿市场
AI客服是Agent商业化落地佳场景,市场价值千亿级。7月22日OpenAI发布面向企业的Agent部署产品Presence,已在其英文客服热线运行,服务质量超人工。这将使它与用其模型搭建方案的公司成竞品。
DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家
一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让大模型自动生成高精度推理数据登上Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。
一个问题几百美元,DeepMind智能体一次搞定了9个Erdős问题
DeepMind团队的大模型在一次‘测试’中解决9个开放的Erdős问题,还自动验证,解法通过人工审查。其框架AlphaProof Nexus结合大模型与Lean编译器,研究展示了AI辅助正式证明搜索技术潜力。
当 AI Coding 进入复杂企业系统,为什么提效远没有宣传里那么美好 ?
以Claude Code、Codex为代表的自主编码智能体席卷开发者生态,但夸大能力现象严重。在复杂企业系统中,AI Coding提效远没宣传美好,存在诸多问题,企业应分级应用、进行约束下的人机协作。
SeePhys Pro:重新审视多模态物理推理中的视觉理解与训练收益
来自中山大学等的研究者提出SeePhys Pro,是面向多模态物理推理的细粒度评测与训练诊断框架。发布了benchmark、训练集等,测评显示当前模型在信息模态转变时不稳定,为模型评测和训练研究提供基础。
14.9g颠覆行业,AI眼镜终于实现无感日常佩戴|甲子光年
在AI硬件浪潮中,AI眼镜被视为有潜力替代手机的形态。心眸科技发布的AI眼镜Moonix,重14.9克,回归眼镜本质,以“记录”为核心,具备主动式AI能力,能实现“记录 - 理解 - 分享”闭环。
一个CLAUDE.md霸榜GitHub第一!蒸馏自Karpathy,6万码农抄作业
一个名为CLAUDE.md的Markdown配置文件冲爆GitHub,本周新增44,465颗星,总星数61.6k,连续三天Trending日榜第一。它源自Karpathy对LLM编程陷阱的观察,含四条规矩,能约束AI编程Agent。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
别只用AI写脚本了,现在AI打广告可真是城会玩了!
如今广告玩法新颖,AI能识别短剧画面插入广告,还能生成贴合IP的番外短片。巨量引擎升级的品星云AI营销,打通“洞察 - 创作 - 投放 - 复盘”全流程,重构AI营销玩法,让决策回归简单。