「小程序游戏」共找到 1422 篇相关文章
开源多模态推理「破壁」时刻:MMFineReason助力4B逆袭30B
长期以来,开源多模态模型在复杂推理任务上与顶尖闭源模型有差距,核心痛点是高质量推理数据匮乏。上海AI实验室OpenDataLab团队开源MMFineReason框架及大规模数据集,小模型凭此实现性能逆袭。
2.2 万 Star 的 AI 虚拟伴侣项目!AIRI,连续一周登上 GitHub 日榜热门!
AIRI是moeru - ai团队开发的开源项目,目标是让用户拥有自己的AI虚拟角色。它受Neuro - sama启发,能陪玩游戏、多端支持、有形象且支持30多种LLM提供商,还在持续发展。
Claude Code开源了代码简化Agent,千年“屎山”代码终于有救了!
Claude Code开源代码简化Agent,可在不改变程序行为下降低代码复杂度。它能自动简化结构、减少冗余,提高可读性。该功能可通过官方插件试用,网友认为其实用,还呼吁更多内部技能开源。
美团之后,京东也开始自研大模型了
京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。
从 RLVR 到 RLSVR:开放式任务如何获得可核验奖励
COLM 2026 论文提出 RLSVR 及 SpyRL,把摘要等开放任务变成“谁是卧底”游戏,用投票生成可核验奖励,在多任务有提升,但也暴露代理目标与质量关系、成本等问题。
ICLR 2026 | Rebuttal 是一场「带着镣铐的舞蹈」?港科 RebuttalAgent 用心智理论「读懂」审稿人
香港科技大学研究团队提出 RebuttalAgent 框架,将心智理论引入学术 Rebuttal 任务。它通过 TSR 框架拆解任务,先‘读心’再‘落笔’,能生成有说服力回复,还可作为‘思维外挂’提升小模型表现。
不怕被挖!谷歌晒IMO金牌团队大合照,还挨个圈出了联系方式
谷歌获IMO金牌后部分成员被小扎挖走,但其IMO金牌团队晒全家福回应。团队负责人透露赛前准备细节,还介绍核心成员情况,包括4位华人成员。
Vercel 发布新语言 Zero:代码不是写给人看的,而是写给 AI 的
Vercel Labs 发布实验性系统编程语言 Zero,定位是速度快、体积小且便于智能体使用修复。Zero 有工具链契约等特色,v0.3.0 有重大转变,不过在 Hacker News 上遭部分质疑。
Anthropic 发布 Computer Use 最佳实践
Anthropic发布Computer Use开发者最佳实践,涵盖截图处理、模型选择、上下文管理等多方面。如缩小截图提升点击准确率,不同模型各有所长,还给出应对小目标、提示注入等问题的策略及教学、顾问模式。
把X接进Codex:AI终于有了自己的信息雷达
作者将X接入Codex,通过官方MCP直接调用X API获取数据。这让AI OS有稳定实时信号输入,成为主动工作系统。介绍接入步骤、费用及使用建议,如先跑小任务。