研究与产品」共找到 7897 篇相关文章

新闻资讯7

Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?

Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。

AI科技评论
新闻资讯7

别装了,AI巨头们!谁在卡脖子,谁在割韭菜?这张图一目了然

卡内基梅隆大学发布首个刻画AI供应链数据集,揭示资本、科技权力「关系网」。供应链上游市场集中或致连锁故障垄断,绘制其链条能助于多项关键分析,看清业全貌。

新智元
开源动态7

FACTS 基准测试套件问世,用于评估大型语言模型的事实准确性

FACTS 基准测试套件由 FACTS 团队 Kaggle 联合开发,基于原 FACTS Grounding Benchmark 增加三个新基准,可从四个维度评估大模型事实性。初步结果显示进展挑战并存,多模态成难题。

InfoQ
开源动态8

CrowdStrike联手Meta发布AI安全基准,让AI在真实网络攻击中证明自己

美国网络安全巨头CrowdStrikeMeta在Fal.Con 2025大会联合推出开源基准测试套件CyberSOCEval,旨在评估AI大语言模型在真实SOC环境下的网络安全能力,它源于Meta之前框架,开源供全球开发者使用。

AIGC开放社区
新闻资讯8

突发,Claude首破黎曼猜想新纪录!

Anthropic让内部研究版Claude证明「黎曼猜想」失败,但它将符合猜想的黎曼Zeta函数零点比例下限从41.6%提升到67.2%。此成果意义重大,标志AI进入开放数学研究

新智元
推荐文章8

两年内打造AI软件工程师!OpenAI Codex 作者解密人机结对编程新模式

AI科技大本营编译访谈,OpenAI的Josh MaAlexander Embiricos分享Codex项目,包括缘起、人AI结对编程范式,还探讨品形态、最佳实践等,预测两年内打造智能体软件工程师。

AI科技大本营
新闻资讯7

马斯克发起编程人机大战!卡帕西说了不

马斯克邀卡帕西Grok 5编程对决,卡帕西婉拒,称更愿合作。网友看法不一,有人认为是马斯克伸橄榄枝,也有人猜测因xAI核心工程师离职,卡帕西或成接班人,未来是否回归待察。

量子位
产品应用8

字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法

近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还谷歌 Nano Banana 对比,各有优势。

机器之心
开源动态8

微软开源全新Agentic网络项目:NLWeb

微软在Build大会宣布五件大事,4件Agent有关,包括升级GitHub Copilot、Copilot调优等。还开源新的NLWeb项目,可让用户用自然语言网站交互,有望在代理网络中扮演类似HTML的角色。

PaperAgent
开源动态8

Sand.ai开源发布MagiCompiler:突破局部编译界限,定义训推性能上限

大模型开发者面临速度显存的两难选择,原生torch.compile有局限。Sand.ai开源MagiCompiler,突破传统编译界限,提出Compiler as Manager理念,解决算力显存墙难题,性能实测亮眼,且接入简单。

机器之心