验证不对称性」共找到 2070 篇相关文章

新闻资讯7

撞名Anthropic的“外挂”刷屏:让“DeepSeek V4‑Pro碾压 Fable 5”但无人能复现,Token开销反而翻倍

J - Space Cognition Suite社区项目在X上传播,称修改DeepSeek V4 - Pro模型权重,用推理时Harness能提升其在多项Agent Benchmark表现,超Fable 5,但未第三方复现,且Token开销可能翻倍。

InfoQ
产品应用7

Karpathy头疼的“AI游戏困境”,被这款15分钟出包的国产神器破解了

8月初Andrej Karpathy指出通用AI做游戏时,LLM无法高效审查工作的弱点。而国产平台Spellcaster能先解析自然语言确定游戏设计,15分钟出包,还内置测试员验证,团队想工程化落地新方向。

AI寒武纪
算法论文8

再止步于自然语言!PhiZero让世界模型学会「物理语言」

PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。

机器之心
开源动态7

Vercel 发布新语言 Zero:代码是写给人看的,而是写给 AI 的

Vercel Labs 发布实验性系统编程语言 Zero,定位是速度快、体积小且便于智能体使用修复。Zero 有工具链契约等特色,v0.3.0 有重大转变,过在 Hacker News 上遭部分质疑。

InfoQ
新闻资讯7

又一位xAI联创宣布创业,押注开源模型和个人AI,融资11亿美元

8月11日,xAI联合创始人伊戈尔·巴布什金创办的River AI完成11亿美元融资。该公司6月成立,团队约20人,刚公开首个产品River API。巴布什金想让企业和个人拥有自己的AI,目前先从企业需求切入。

DeepTech深科技
算法论文8

文生图Scaling新变量,被字节Seed团队发现了

ByteDance Seed团队研究发现,文生图模型中自然语言Caption变长,意味着模型获更多视觉监督,其信息量更能预测训练损失。团队提出Structured Prompt,从两侧提升文本条件,在多任务上取得显著提升。

机器之心
产品应用7

具身智能的第四阶段:「造系统」?

进入2026年下半年,业内形成共识:具身智能竞争从单一模型比拼转向系统工程与产业基础设施角逐。鹿明机器人推出具身智能开发与验证平台Lumos Station Lite,提出“产业具身”理念,助力具身智能落地。

AI科技评论
产品应用8

智源悟界·RoboBrain Orca:多模态表征世界模型

智源研究院悟界·RoboBrain Orca团队发布技术报告,探索让模型学习世界表征,从‘预测下一个词’走向‘预测下一状态’。它通过多模态数据学习,经实验验证有效,虽处早期阶段,但提出值得扩展的方向。

新智元
开源动态8

完全免费!Claude Science开源平替,DeepSeek/GLM想用哪个用哪个

Anthropic发布面向科学家的AI工作平台Claude Science,能集成科研工具、多智能体协作等,但有系统、付费和模型使用限制。YC孵化团队推出开源平替OpenScience,绑定模型厂商,功能更丰富且安装简单。

量子位
算法论文8

Anthropic 在 Claude 内部发现"全局工作空间",可以直接读取模型没说出口的想法

Anthropic发布研究,在Claude内部发现J - space(雅可比空间),即“全局工作空间”,它在训练中自发形成。用雅可比透镜技术可读取其内容,还验证了其功能属性,可用于对齐审计等。

AI工程化