「中文字生成」共找到 4581 篇相关文章
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,仅做出一题,DeepSeek R1 挂零。不同模型架构在比赛中差异不大,暴露出大模型做算法题短板,推理模式模型表现更好。
Learning from peers!让LRM互相「传纸条」的新协作方式大幅提高准确率和效率
当前主流大模型如QwQ - 32B存在“前缀主导陷阱”,推理开头出错会使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越大模型,开创了多种可能性。
谷歌发76页智能体白皮书!你的「AI替身」已上线
谷歌发布76页AI智能体白皮书,剖析其应用前景。涵盖智能体运维、评估方法,探讨多智能体架构,还介绍智能体增强检索生成及企业应用,如NotebookLM企业版、Agentspace空间企业版等。
AgentA/B:用AI模拟用户,真人AB测试或将成为历史
宾夕法尼亚州立大学和亚马逊合作研发AgentA/B测试框架,用大语言模型生成虚拟用户模拟真实行为,成本低、速度快,还能绕开真实流量测试。虽有人质疑,但它或改变传统AB测试。
终于用上啦,3.9 万 Star archify,程序员福音!!!!
架构图常与代码脱节,约3.9万Star的archify让Agent先把代码库或系统描述写成带类型的JSON,经布局、检查后交付可交互系统地图,它先结构化、验证再交付,适用于特定场景。
GPT-6来了,立摘ASI坐标系今日金牌!
OpenAI 正式发布 GPT - 6 Astra,在多项测试中表现优异。近期 Anthropic、谷歌也有新模型发布。马斯克、Altman 对 AI 发表看法。新智元决定做 ASI 坐标系,相关官网 9 月 7 日上线,现征集需求。
0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26
大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。
吴恩达新作:87%推理token用不着,丢掉反而快3倍
吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。
Lady Gaga进军AI生物科技:用“活体皮肤”训练模型,筛选抗衰老成分
当地时间8月21日,美国歌手Lady Gaga公开参与创办的生物技术公司Outer Biosciences及核心平台Yuna,该司用机器学习等结合离体人体皮肤,从海量化合物中找新护肤成分,已融资约2300万美元。
没有全科优秀,具身模型别想进入百万小时
文章介绍权威评测 RoboDojo,给全球机器人模型办‘高考’,多数具身模型离落地远。原力灵机的 DM0.5 模型登顶,它记忆能力强、全科优秀,且全面开源,有望推动具身智能发展。