Code World Model」共找到 1105 篇相关文章

算法论文8

跨越技术与法律的壁垒:AI赋能知识产权领域任务全能评测基准IPBench发布

本推文介绍arXiv论文《IPBench: Benchmarking the Knowledge of Large Language Models in Intellectual Property》。论文提出IPBench评估基准,构建含20个任务、10374个双语数据点的基准,评估17个主流模型,揭示现有模型在IP任务中局限。

深度学习自然语言处理
产品应用7

GPT-5-Codex 一手实测

OpenAI推出新编程模型GPT - 5 Codex,Every团队实测显示其表现狂野。它能动态选思考时间,可在不同开发环境无缝切换,代码审查更优。但也存在对任务挑剔、环境设置麻烦等问题。

AGI Hunt
算法论文8

ICLR2025 | LLM为什么能拒绝回答有害问题呢?

该论文首次系统性研究注意力头在LLM安全中的作用,提出Ships和Sahara方法,在极少参数改动下显著降低模型安全性,发现不同模型安全头高度重叠,为理解模型安全机制提供新视角。

深度学习自然语言处理
开源动态8

媲美Claude 4,支持100万上下文!阿里开源超强代码AI Agent模型

阿里巴巴开源超强AI Agent模型Qwen3 - Coder - 480B - A35B - Instruct,测试分数媲美Claude Sonnet 4,超越DeepSeek。它参数多、支持大上下文窗口,训练数据优质,还进行代码强化学习扩展训练等,有对应命令行工具。

AIGC开放社区
新闻资讯7

Lovable 完成 2 亿美金融资,Newsletter 产品 Beehiiv 年营收突破 3000 万美金

Vibe Coding 产品 Lovable 完成 2 亿美元 A 轮融资,估值 18 亿美元。其活跃用户 230 万,付费用户超 18 万,ARR 近 9000 万美元。Newsletter 产品 Beehiiv 年营收突破 3000 万美元,创始人分享 20 条创业思考。

投资实习所
算法论文8

首个全面梳理语音大模型发展脉络的权威综述,入选ACL 2025主会

香港中文大学团队语音语言模型综述论文《Recent Advances in Speech Language Models: A Survey》被 ACL 2025 主会议接收,这是该领域首个全面系统综述,指明语音 AI 未来方向,还剖析技术架构、训练策略等。

机器之心
新闻资讯7

程序员从此不再写代码!红杉专访Codex团队,o3白菜价真相曝光

红杉专访OpenAI Codex团队,揭示AI编程未来。Codex从代码补全演化为智能体,强调委托心态,开发者从动手转向审核。还爆料OpenAI内部有递归自我改进的AI Alice。

新智元
开源动态7

马斯克点赞的APP来了!刚下场视频世界模型,就拿下评测第一

实时视频世界模型成热门,Loopit发布的实时互动世界模型Zing - 0.5在评测中获第一且已开源。该公司提出独特观点,认为实时视频非世界,互动应“模应一体”,还指出抵达端到端终局的新路径。

新智元
推荐文章7

别再设计 Prompt,顶尖工程师已经开始写 Loop 了!

2026年6月,“Loop Engineering(循环工程)”一词热门起来。其核心主张是不用再亲自给AI写提示词,而是设计驱动Agent的循环。Anthropic的工程师还写成了完整手册,介绍搭建方法、关键及最佳实践等。

特工宇宙
开源动态7

爆火「开源投资框架」,AI时代的伯克希尔

AI投资虽火但常给出正确废话,AI Berkshire爆火,兼容Claude Code和OpenAI Codex,有18个Skill。它将四位投资大师方法论抽象成流程,通过多Agent协作完成投研闭环,还有强制给结论等特点。

开源AI项目落地