「AI原生团队」共找到 11763 篇相关文章

算法论文7

VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

视觉问答模型准确率提升,但高分可能源于记忆。浙江大学等团队提出 ReKey,保留真实场景,只更新决定答案的视觉线索,使评测面向未见过内容,且多数环节可自动完成。

机器之心
算法论文8

让沉默三千年的甲骨开口:首个模仿人类专家工作流的辅助释读系统

近日,华中科技大学等联合团队推出首个模拟专家释读流程的人工智能系统AlphaOracle,辅助甲骨文破译。它整合多类资料,形成证据链,经专家评估,有较高评价且能节省分析时间。

新智元
新闻资讯7

紧跟诺奖得主,斯坦福经济学泰斗火速入职Anthropic!

IPO敲钟前夜,斯坦福经济学教授Charles I. Jones(Chad Jones)将加入Anthropic研究所。该公司正组建‘政经智囊团’,因民调显示64%美国人恐慌AI夺饭碗,需Chad Jones用经济学模型应对。

新智元
产品应用7

Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦

Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正从“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。

AI科技评论
算法论文8

刘陈立领衔!六国学者联合发布亚洲合成细胞技术路线图

由刘陈立牵头的联合团队发表论文,提出亚洲合成细胞技术路线图。它指出构建合成细胞的四大挑战,提出新型研究范式和十年两阶段目标,体现亚洲科研协作原创探索,推动国际合作。

DeepTech深科技
算法论文8

ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速

琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同大模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。

机器之心
算法论文8

ICLR 2026 Oral | 没人诱导,大模型也会「骗人」

新加坡国立大学 Bingsheng He 教授团队论文关注无诱导下大模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。

机器之心
开源动态7

分享一个 OpenClaw 装机必备 Skills 库

腾讯推出代装龙虾公益活动引关注,OpenClaw创始人也转发。GitHub上的awesome - openclaw - skills项目爆火,收录超五千个OpenClaw装机必备Skill,覆盖多场景,还呈现AI Agent发展趋势。

特工宇宙
开源动态7

FACTS 基准测试套件问世,用于评估大型语言模型的事实准确性

FACTS 基准测试套件由 FACTS 团队与 Kaggle 联合开发,基于原 FACTS Grounding Benchmark 增加三个新基准,可从四个维度评估大模型事实性。初步结果显示进展与挑战并存,多模态成难题。

InfoQ
新闻资讯7

Gemini 3 上线两周,ChatGPT 日活下降 6%,Altman 内部信拉响红色警报

2025年12月初,AI领域权力转换,Google新一代多模态模型Gemini 3挑战ChatGPT。自其发布两周,OpenAI日活降6%。Sam Altman发内部信拉响警报,要求聚焦提升ChatGPT核心体验。

MacTalk