「自闭环验证」共找到 2082 篇相关文章
Fable 5榜单第一靠作弊?代码泄露,模型真实身份曝光
黑客泄露Claude Fable 5长达12万字符的系统提示词,揭示它并非大模型,而是伪装成LLM的完整Agent系统。这颠覆了对AI模型的认知,也让Anthropic陷入舆论漩涡,还暴露了其计费黑幕。
软体机器人控制难题获解,比传统方法节能75倍,还能闭眼干活
美国两校研究人员结合生物学与人工智能工程学,用‘神经储备池’技术控制生物混合软手臂,实现稳定追踪、自我感知和低能耗运行,还在多方面展现优势,目前研究处于仿真阶段。
乐鑫开源首个「物联网设备Agent框架」,Claw的风终于吹到硬件上
乐鑫开源首个物联网设备Agent框架ESP - Claw,用C语言重写。它核心理念是对话即创作,可让用户通过聊天定义硬件行为。具备运行效率高、内存占用低等特点,还有多种功能及良好的生态适配性。
ICML 2026 | 只用少量Thinking Tokens,大模型依然能深度思考
近年来,CoT 推理成为提升大模型复杂问题求解能力的重要路径,但带来效率问题。浙江大学等团队提出 Heima 框架,将冗长 CoT 压缩为少量 thinking tokens,在减少 token 数的同时保留推理能力,已被 ICML 2026 接收。
ICML 2026 |让大模型边想边说:这篇文章把「何时开口」变成可学习策略
论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为可学习决策,经实验验证效果良好。
Anthropic发布「AI原生创业公司」手册:涵盖全流程四大核心阶段,一人公司法典来了
Anthropic发布打造AI原生创业公司手册,针对2026年可能性梳理创业四阶段:想法、MVP、上线和规模化,明确各阶段目标、退出标准、失败模式及AI实操练习,涵盖研究、编码、运营等方面。
号称1200万token上下文的模型来了,数据亮眼但疑点重重
当地时间5月5日,Subquadratic公司推出模型SubQ,称是LLM智能重大突破,有1200万token上下文。数据亮眼,如在1M token场景比FlashAttention快52倍等,但也引发质疑,有人推测是对开源模型微调,官方未公布详细模型卡。
Karpathy的软件3.0:Agent的原生世界
OpenAI联合创始人Andrej Karpathy在Sequoia Ascent大会上表示,AI Agent正改变软件与工作模式。编程基本单位从写代码变为给Agent下达指令,软件3.0以上下文窗口为程序,LLM为解释器。他还提出理解AI能力分布的框架,给出创业建议。
上市首日大涨383%,上海跑出“全球AI硅光芯片第一股”
4月28日,曦智科技在港交所上市,首日涨幅383.62%,认购阶段成绩亮眼。其由沈亦晨创立,从光计算转型光互连后迎来转机。虽营收增长但亏损大,研发投入高,此次IPO募资用于研发等。
openJiuwen社区首发「Coordination Enginnering」,让智能体从「单兵作战」到「精锐团队」
openJiuwen社区围绕Coordination Engineering发布多智能体协同技术体系,包括Agent Team、Team Skills等。该体系解决多智能体协作问题,实现团队自主协作、经验沉淀与进化,还提供相关工具和平台。