是石科技」共找到 4776 篇相关文章

算法论文8

大模型越反思越错,原来长链推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
算法论文8

大模型到底怎么「思考」的?第一篇系统性综述SAE的文章来了

在大语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等多方面内容。

机器之心
新闻资讯7

15亿美元AI独角兽崩塌,全印度程序员冒充!微软亚马逊惨遭忽悠

Builder.ai自称用AI简化软件开发,吸引微软、软银等巨额投资,估值超15亿美元。但实际靠人工冒充AI,创始人虚报营收。丑闻曝光后投资被冻结,公司破产,引发AI交易技术尽职调查讨论。

新智元
产品应用7

AI 视频生成“试金石”:谷歌 Veo 3 体操“图灵测试”未达标,仍“抽象派”!

谷歌新出的Veo 3视频生成模型画质惊艳且能开口说话,但生成体操动作效果差,像“抽象派”。虽存在生成不准问题,但物理效果比其他模型好。有人建议其与专业动捕公司合作,音画一体或成视频模型竞赛标配。

AI进修生
推荐文章9

想给产品加一个 AI 搜索,上向量数据库还用 MongoDB 就够了?

本文解答产品添加AI搜索时,选用专用向量数据库还MongoDB的选型疑问,理清两类检索的能力边界,讲解MongoDB检索的架构、用法与踩坑点,给出可复用的选型判断框架。

AI Reading Hub
新闻资讯7

Axiom Math 对谈 SGLang:模型的下一步可验证,结果层才真正的护城河

在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,可验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。

Founder Park
产品应用7

“豆包工作”已经我的主力 Agent:查数据、做内容、协作,一条链全接住

这几天豆包工作推出独立应用,作者用两天后将其作为主力 Agent。它把模型能力和工具生态组合成工作系统,能拿齐信息、加工材料,产物可交下一步,还能跨端接力。

AI产品自由
新闻资讯7

20%的美国打工人把活儿甩给AI!被替代的任务,不岗位

8月6日,Epoch AI联合Ipsos发布职场调查报告,20%美国就业者将工作甩给AI,表明活儿在人和AI间重新分配。AI参与广但不深入,用时情况不一,输出多需修改,先冲击外包工作,且使用不均衡。

新智元
新闻资讯7

专访酷哇杨学:世界模型的下半场,把一次成功变成长期服务|甲子光年

在2026世界人工智能大会上,具身智能行业关注点从机器人能动转向能否进入真实场景干活。酷哇科技宣布杨学出任首席科学家,共建通用具身智能联合实验室。杨学认为行业应从证明技术转向证明实用,解决机器人在真实场景的长期稳定运营问题。

甲子光年
产品应用8

SeeDance 2.5:AI 一次能出 30 秒视频,被重新定价的这几层人

7 月初,字节在火山引擎 FORCE 大会上放出 SeeDance 2.5,它能一次性生成 30 秒完整成片。文章详述其能力,提出视频生成的不可能三角判断框架,还分析它会重新定价产业链上多个环节,改写产出随机性。

AI Reading Hub