新闻解读
事件要点与影响
搜索问答
常见问题
常见问题
有多少比例的企业经历过面向客户的AI代理失败?
调查显示,50%的组织部署了通过内部评估但在生产环境中导致客户失败的代理。
企业目前对自动化评估的信任程度如何?
仅有5%的技术领导者表示完全信任自动化评估,他们认为与真实世界结果的对齐度差是主要弱点。
企业是否在无人工监督的情况下部署代理?
是的,66%的组织要么目前允许完全自动化、零人工介入的部署,要么正在构建工程管道以在十二个月内实现这一目标。
继续追踪
相关新闻

VentureBeat AI
智能体编排:企业AI组织面临的是部署问题,而非平台问题——且多数企业将聊天机器人误称为智能体
VentureBeat的研究揭示了企业AI雄心与现实之间的差距:尽管Anthropic的Claude在编排平台中领先,但71%的“智能体”仅是简单的聊天机器人包装,且大多数缺乏实时成本控制机制。

VentureBeat AI
AI上下文鸿沟:企业AI组织面临的是信任问题,而非检索问题——且大多数仍在构建解决方案
VentureBeat的研究揭示了企业AI中的“上下文鸿沟”:57%的企业因检索不可靠而面临智能体幻觉问题。尽管提供商原生工具的使用率领先,但组织仍难以信任底层上下文。

VentureBeat AI
AI算力鸿沟:企业购买基础设施的速度快于其核算成本的能力
VentureBeat的研究揭示了107家企业中存在的严峻“算力鸿沟”:AI基础设施支出加速增长,但仅有44%的企业跟踪成本,且83%的企业GPU利用率不足,这促使他们计划更换服务提供商。

VentureBeat AI
智能体安全缺口:54%的企业已发生AI智能体事件,且多数仍允许智能体共享凭据
VentureBeat的研究揭示了一个关键的“智能体安全缺口”:尽管54%的企业曾遭遇AI事件,但大多数企业仍依赖共享凭据和提供商原生控制措施,而非专门构建的隔离机制。

VentureBeat AI
Claude Code 每月费用高达 200 美元,而 Goose 免费提供相同功能。
Goose 是 Block 公司推出的免费开源 AI 编程代理,与 Claude Code(每月 20-200 美元)竞争,支持本地执行、无订阅、无速率限制。自发布以来已获得 26K+ GitHub 星标和 102 个版本。

VentureBeat AI
Nous Research的NousCoder-14B:在Claude Code时刻发布的开源编程模型
Nous Research发布了NousCoder-14B,一个开源编程模型,性能媲美更大的专有系统,在48块Nvidia B200 GPU上训练了4天。它在LiveCodeBench v6上达到67.87%的准确率,比Qwen3-14B提升了7.08%。此次发布包含完整的训练栈,确保可复现性。
站内探索
继续探索 AI 生态
看完这条新闻后,可以继续查看相关工具、模型和榜单,快速判断这件事对你的选择有没有影响。