内部试用」共找到 407 篇相关文章

新闻资讯7

OpenSandbox:重新思考 Agent 时代的 Runtime|QCon 北京

4月16 - 18日QCon全球软件开发大会将在北京举办,聚焦Agentic AI时代软件工程重塑。阿里陶宇田将分享《OpenSandbox:重新思考Agent时代的Runtime》,结合阿里实践解析关键设计与经验,大会还有20多个专题论坛。

InfoQ
产品应用8

OpenAI 发布新的 Codex 桌面版,我现在不骂 Codex 难用了

OpenAI发布Codex Desktop App,是macOS桌面应用。它有图形界面,支持定时任务、Skills管理和多Agent并行运行。还对比了与Claude Code的差别,介绍了OpenClaw项目,最后说明不同用户的使用场景和用量定价。

宝玉AI
新闻资讯7

Anthropic 为什么推出 Skills?它会革谁的命!

近期Claude Code出圈,开发者基于其构建应用。Anthropic 作为先驱,在 MCP 后推出 Skills,旨在解决现有技术架构痛点,它是标准化 SOP,有分层设计优势,还推荐了 skill0.atypica.ai 平台。

AI工程化
7

28岁华人执掌1.85万亿科技巨头AI大权!一觉醒来,图灵奖得主也要向他汇报

Meta超级智能实验室一拆四,28岁华人Alexandr Wang出任负责人获扎克伯格力挺。内部信强调‘超级智能即将到来’,宣布实验室拆分,AGI Foundations团队解散成员分流,Yann LeCun地位降级。

新智元
算法论文8

ACL 2025|自我怀疑还是自我纠正?清华团队揭示LLMs反思技术的暗面

本文指出反思技术虽简单有效,但在多种LLMs和任务中会失败。清华团队剖析其在开源和闭源LLMs、四种任务上失败原因,提出轻量级缓解方案,为反思技术可解释性研究奠基。

机器之心
新闻资讯7

刚刚,北大校友Lilian Weng自曝公司首个产品?一篇论文未发,估值却已90亿

OpenAI前安全副总裁Lilian Weng疑似曝光90亿估值新公司Thinking Machines首个产品——手动调参仪表盘,训练中可手动调超参数。OpenAI也有AI硬件野心,设想让ChatGPT成全能硬件助手。

新智元
新闻资讯8

OpenAI Codex负责人 Tibo访谈:指明未来Agent方向以及为什么频繁重置额度

近期OpenAI Codex负责人Tibo接受采访,透露产品方向与技术路线,如让Agent深度理解用户、合并ChatGPT和Codex等,还谈及保持迭代、对竞争态度、重置用量限额等问题。

AI工程化
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的可信验证框架

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。

机器之心
开源动态8

MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一

MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。

AI工程化
新闻资讯8

阅读7千万文章硅谷爆火:AI奇点已至,抛弃人类自我进化!

文章指出本月AI质变式飞跃,能独立完成复杂工作,递归自我提升循环已启动。如GPT - 5.3 - Codex有判断力和品位,AI构建自身进程加速。多数人认知滞后,作者给出应对建议,也提及AI带来创造机遇。

新智元