AI开始会说“我不确定”了:Claude Opus 4.8的两个0%,改写了什么?

Anthropic发布Claude Opus 4.8,首次实现两项关键指标零错误:谎报率和偷懒调查率均为0%,意味着AI不再假装懂行,会主动说“不确定”。在编程评测SWE-Bench Pro中得分69.2%,领先GPT-5.5超10个百分点;智能体能力Elo得分1890,胜率高达67%。新增“动态工作流”功能,可并行运行数百个子代理,完成代码库级迁移,效率提升15%,token消耗减少35%。定价与上代持平,快速模式价格降至三分之一。下一代模型Mythos将在几周内全面开放,已发现超1万个安全漏洞。

谷歌I/O炸场!Gemini 3.2 Flash+Android 17 AI Core,AI渗透全生态

北京时间5月20日凌晨1点,Google I/O 2026开发者大会在美国加州山景城正式拉开帷幕。x0dx0ax0dx0a这场被

Anthropic 让用户将更多应用程序连接到 Claude

Anthropic 周四推出了一种将应用程序和工具连接到其 AI 聊天机器人 Claude 的新方法,以及扩展的“深度研究”功能,使 Claude 能够搜索网络、企业帐户等。 名为“Integrations”的全新应用连接功能以及名为“Advanced Research”的扩展深度研究工具现已面向 Anthropic 的 Claude Max、Team 和 Enterprise 计划用户开放 Beta 测试版,Pro 版也即将推出。另据相关消息,Anthropic 还提高了其 AI 驱动的编码工具Claude Code的 Max 用户使...

据报道,苹果和 Anthropic 合作打造 AI 编码平台

据彭博社周五报道,苹果和 Anthropic 正在联手打造一个“氛围编码”软件平台,该平台将使用生成式人工智能为程序员编写、编辑和测试代码。 据彭博社报道,这家 iPhone 制造商计划在内部推出该软件,但尚未决定是否公开发布。据报道,该系统是苹果编程软件 Xcode 的新版本,依赖于 Anthropic 的 Claude Sonnet 模型。 为了加速其人工智能发展,苹果似乎正在利用合作伙伴网络。OpenAI 的 ChatGPT 已经为该公司的 Apple Intelligence...

Anthropic 启动支持科学研究的计划

Anthropic 启动“AI for Science”计划,为从事生物学和生命科学等“高影响力”研究的科学家提供最高2万美元的API积分,可使用包括Claude在内的AI模型。该计划旨在利用AI推理和语言能力加速数据分析、假设生成、药物研发和农业生产力提升。申请将依据科学价值、影响力和技术可行性等标准每月评审。尽管业界看好AI加速科学发现,但许多研究人员认为当前AI在指导科学进程上仍不可靠,且此前类似尝试(如谷歌GNoME)成果有限。Anthropic希望该计划能取得更好成效。

客服微信

点击复制微信号