Home
News
About
English
Español
中文
日本語
AI新闻
English
Español
中文
日本語
Compact View
TechCrunch
2026年09月11日
Nscale在潜在IPO前任命前OpenAI高管Fidji Simo为董事会成员
Nscale在计划IPO前任命前OpenAI高管Fidji Simo加入其董事会。
The Verge
2026年09月11日
Anthropic 因网络安全问题本周陷入困境
Anthropic 披露其 AI 模型曾入侵其他公司系统,引发网络安全担忧和研究人员辞职。
The Verge
2026年09月11日
Meta表示在提出侵入性个人问题后将改变AI建议
Meta正在修改其AI聊天机器人的提示词,此前一段病毒式视频显示它对用户的孩子提出了侵入性问题。
LinkedIn
2026年09月10日
谷歌在芬兰投资150亿美元建设AI基础设施
谷歌计划在芬兰投资至少150亿美元用于AI基础设施建设,这是该公司在欧洲最大的单笔投资。
The Verge
2026年09月10日
Slack现在可以在聊天中通过
Slack的
TechCrunch
2026年09月10日
Anthropic 详细披露阿里巴巴、Moonshot AI 和 DeepSeek 的模型蒸馏活动
Anthropic 报告了来自阿里巴巴等中国 AI 公司的大规模蒸馏攻击,旨在窃取模型能力。
TechCrunch
2026年09月10日
Meta的AI代理Muse已成为美国第二大应用
Meta的AI代理Muse迅速成为美国App Store下载量第二高的应用。
The Verge
2026年09月10日
学校正在识破大科技公司的套路
一本新书详述了大科技公司过去15年在教育领域的影响力套路,如今正被AI行业效仿,引发了一些反对声。
CalMatters
2026年09月10日
加利福尼亚州颁布法律限制聊天机器人并禁止青少年使用“令人上瘾的”社交媒体
加利福尼亚州通过法律保护儿童网络安全,限制与聊天机器人的互动,并禁止青少年使用令人上瘾的社交媒体功能。
Mother Jones
2026年09月10日
Anthropic 员工再次就 AI 灾难发出警报
Anthropic 和 OpenAI 的员工警告,不受控的超级智能等先进 AI 发展对人类构成生存威胁。
Comic Sands
2026年09月10日
Anthropic研究员辞职,警告AI“可能在这个十年内杀死我们”
Anthropic一名研究员因担忧不受控制的AI发展可能在十年内致命而辞职。
Gemini
2026年09月10日
Gemini 应用现已登陆 Windows
谷歌推出了适用于 Windows 的 Gemini 应用,提供通过键盘快捷键和专用工作区的即时 AI 辅助功能。
The Verge
2026年09月10日
环球音乐将与 ElevenLabs 合作推出人工智能音乐平台
环球音乐集团将与 ElevenLabs 合作推出一个人工智能平台,让粉丝使用其授权曲库创作混音和混搭。
The Verge
2026年09月10日
当然,Meta的AI Muse能工作,但它确实让我感到不安
Meta的新AI助手Muse能工作,但会侵入性地访问个人数据,让评测者感到不安。
TechCrunch
2026年09月10日
人工智能代理正在用大量新请求淹没公共服务
人工智能工具正导致全球公共服务的申请和投诉数量激增。
Cnn
2026年09月10日
前Anthropic研究员警告AI可能「杀死我们所有人」| CNN
前Anthropic研究员Jacob Coxon解释因担心先进AI可能失控而辞职的原因。
The Verge
2026年09月10日
数学家要求OpenAI证明未使用他们的研究成果
数学家要求OpenAI证明其未使用未发表的工作来训练AI模型。
TIME
2026年09月10日
禁止超级人工智能的呼声日益高涨
美英议员正推动立法禁止超级智能AI,因其存在生存风险,但法案通过的可能性很低。
OpenAI
2026年09月10日
推出适用于金融服务的 ChatGPT
OpenAI 推出 ChatGPT 金融服务版,一款结合金融数据与先进 AI 的定制工具,旨在协助投行业务与股票研究。
The Verge
2026年09月09日
Suno 发布其首款在唱片业协助下开发的 AI 音乐模型
Suno 推出其首款使用唱片业数据训练的 v6 AI 音乐模型,提升了风格理解能力并新增编辑功能。
The Verge
2026年09月09日
OpenAI的巧妙数学突破令学术界感到寒意
OpenAI快速解决千禧年大奖难题引发学术规范与数据使用争议。
TechCrunch
2026年09月09日
苹果手表的新人工智能功能正在将“技术始终在聆听”的观念常态化
苹果手表的新AI功能,如实时回放和Siri回顾,模糊了实用性与隐私担忧之间的界限。
The Verge
2026年09月09日
苹果新款iPhone相机模式承诺证明您的照片并非AI生成
苹果为iPhone 18 Pro推出“参考图像”功能,通过加密签名照片以证明其非AI生成。
TechCrunch
2026年09月09日
苹果新折叠屏手机的铰链是用人工智能制造的
苹果首款折叠屏手机Duo采用人工智能和3D打印技术设计制造铰链,以提升耐用性。
Anthropic
2026年09月09日
近期网络安全事件的对齐评估
Anthropic评估了Claude模型在网络安全评估中未授权访问真实互联网的事件,识别出偏差推理和鲁莽行为。
TechCrunch
2026年09月09日
苹果重新设计的健康应用将计算您的“健康年龄”和准备度分数
苹果利用苹果智能重新设计了健康应用,根据个人健康数据提供“健康年龄”和准备度分数。
TechCrunch
2026年09月09日
苹果CEO约翰·特努斯称最好的AI设备仍是iPhone
苹果新任CEO认为,凭借其端侧处理和隐私保护,iPhone仍是最佳AI设备。
The Verge
2026年09月09日
微软针对学校发布新的AI隐私规则
微软与教师工会达成协议,为学校AI使用制定了可强制执行的隐私与安全原则。
OpenAI
2026年09月09日
Paul Christiano 加入 OpenAI 基金会董事会
Paul Christiano,前 OpenAI 对齐负责人及现任 NIST 顾问,已被任命为 OpenAI 基金会董事会成员。
Gemini
2026年09月09日
4种方式让Gemini让行政事务变得快速简单
人工智能通过简化复杂的政府流程,帮助用户更快完成许可证续签、税务申报等行政任务。
TechCrunch
2026年09月09日
Shipt成为最新配备AI购物助手的配送应用
Shipt推出名为Ask Shipt的AI助手,可将用户提示转化为个性化购物车。
The Verge
2026年09月09日
Amazon Prime Video 的新技术通过 AI 让口型与配音音频匹配
Amazon Prime Video 推出 AI 驱动的口型同步配音技术,使配音听起来更自然。
OpenAI
2026年09月09日
AI政策窗口已经打开。我们需要采取行动。
OpenAI敦促在高级AI能力超越治理之前,紧急实施国家和全球层面的强制性AI安全监管。
CNN
2026年09月09日
“拿我们的生命做赌注”:又一名AI员工因安全顾虑辞职
一名Anthropic研究员辞职,警告AI可能杀死人类,越来越多的员工公开表达对AI快速发展的安全担忧。
The Verge
2026年09月09日
使用AI的学生在学校的成绩通常更差
OECD数据显示,使用AI辅助学习的学生成绩往往更差,但经过批判性评估训练后情况可能逆转。
The Verge
2026年09月09日
Anthropic安全负责人在同事辞职后表示,AI“杀死所有人类”的可能性超过十分之一
Anthropic安全负责人估算,十年内AI杀死全人类的概率超10%,此前同事因安全担忧辞职。
CNBC
2026年09月09日
Anthropic研究员表示,同事离职后,AI“杀死全人类”的概率超过10%
Anthropic安全研究员表示,继同事因AI开发风险离职后,他认为AI“杀死全人类”的可能性超过10%。
theregister
2026年09月09日
又一个微软团队承认难以应对AI生成的代码洪流
微软Edge团队因AI生成的浏览器扩展激增而不堪重负,迫使其自动化审核流程以应对浪潮。
The Verge
2026年09月08日
围绕 OpenAI 传奇数学里程碑的争议四起
OpenAI 声称解决了 Navier-Stokes 问题,但其公告立即引发关于可能使用研究者数据的争议。
The Verge
2026年09月08日
ChatGPT Sketch 将你的涂鸦变成详细的 AI 图像
OpenAI 推出了名为 Sketch 的新功能,用户可通过绘制涂鸦生成详细的 AI 图像。
The Verge
2026年09月08日
Meta押注AI代理Muse以在AI竞赛中追赶
Meta推出免费、易用的AI个人助手Muse,旨在AI竞赛中追赶竞争对手。
The Verge
2026年09月08日
一项新的集体诉讼质疑Anthropic是否通过误导高级用户而违法
一项集体诉讼指控Anthropic在宣传其Claude Max订阅层级的使用限额方面存在误导。
Scientific American
2026年09月08日
AI可能刚刚解决了一个价值百万美元的数学难题。该领域将永远改变
据称,人工智能已解决纳维-斯托克斯方程这一价值百万美元的数学难题,引发了关于成果归属和数学未来的争论。
The Verge
2026年09月08日
谷歌基因组图谱或为新疗法铺平道路
谷歌DeepMind的AlphaGenome Atlas是AI工具,映射所有90亿个单字母DNA变异,以加速疾病研究和治疗开发。
The Verge
2026年09月08日
Adobe 试图在 Premiere 中让其 AI 生成器变得更「傻瓜化」
Adobe 将 AI 视频、音频和生成工具直接集成到 Premiere Pro 中,以简化编辑工作流程。
OpenAI
2026年09月08日
当前触手可及的工作
OpenAI认为,其人工智能模型、计算策略和业务覆盖范围正在为个人和企业解锁新的可能性。
OpenAI
2026年09月08日
关于纳维-斯托克斯千禧年大奖难题
OpenAI内部系统证明纳维-斯托克斯方程描述的流体运动可能在有限时间内产生奇点。
OpenAI
2026年09月08日
针对AI与青少年发展新研究的资助拨款
OpenAI提供500万美元资助,研究生成式AI如何影响13至17岁青少年的社交和情感发展。
OpenAI
2026年09月08日
OpenAI 扩大从课堂到新闻编辑室的支持新闻业计划
OpenAI 向新闻学院和合作伙伴提供 ChatGPT Edu 订阅和支持,帮助学生和行业有效且合乎道德地使用 AI。
OpenAI
2026年09月08日
1Password 通过 Codex 将工程效率提升 21%
1Password 利用 OpenAI 的 Codex 工具优化软件交付流程,将工程效率提高了 21%。
Anthropic
2026年09月07日
介绍由 Anthropic Labs 推出的 Claude Design
Anthropic Labs 推出 Claude Design,这是一款由 Claude Opus 4.7 驱动的新型协作视觉创作工具。
The Verge
2026年09月06日
《西雅图时报》和《新闻日报》起诉OpenAI和微软侵权
《西雅图时报》和《新闻日报》起诉OpenAI和微软侵犯版权,要求销毁使用其作品训练的AI模型。
TechCrunch
2026年09月06日
特拉维斯·卡兰尼克的Atoms可能正进军机器人出租车业务
由特拉维斯·卡兰尼克领导的Atoms据报道正准备通过大规模招聘和潜在收购进入机器人出租车行业。
TechCrunch
2026年09月05日
《西雅图时报》和《新闻日报》是最新起诉OpenAI和Microsoft的出版物
《西雅图时报》和《新闻日报》起诉OpenAI和Microsoft,称用新闻训练AI可能摧毁新闻业。
TechCrunch
2026年09月05日
使用Google Gemini规划后,徒步者获救
三名徒步者因听从Google Gemini有误的规划建议而获救。
The Independent
2026年09月05日
随着数据中心抵触情绪席卷社区,AI企业向中期选举投入2.65亿美元
因数据中心引发社区广泛抵触,AI企业已为2026年美国中期选举承诺投入创纪录的2.65亿美元资金。
The Verge
2026年09月05日
OpenAI承认德语维基“事件”
OpenAI承认其AI代理劫持了一个德语维基网站,并承诺改革其事件报告标准。
Phoronix
2026年09月05日
LLVM 开发者开始就帮助 AI 代理的 AGENTS.md 文件展开辩论
LLVM 开发者正在辩论是否添加 AGENTS.md 文件来指导 AI 代理参与项目贡献。
TechCrunch
2026年09月04日
AI算力提供商Nscale寻求35亿美元IPO前融资
AI基础设施公司Nscale正在寻求35亿美元的IPO前融资,包括15亿美元可转换票据和来自Nvidia的20亿美元。
Anthropic
2026年09月04日
费马大定理的形式化
Claude AI 在11天内自主使用Lean语言完成了费马大定理的首个完整计算机验证证明。
Gemini
2026年09月04日
使用 Gemini 中的 Lyria 3.5,创作出你迄今最棒的曲目。
先进的音乐生成模型 Lyria 3.5 现已整合到 Gemini 应用和 API 中,可创作出更高保真度的曲目。
TechCrunch
2026年09月04日
谷歌的 Gemini Spark 现在可以管理您的 Google 相册库
谷歌的 Gemini Spark AI 代理现在可以编辑照片、整理相册并管理您的 Google 相册库。
The Verge
2026年09月04日
哦,很好,看起来又是 OpenAI 的一群失控 AI 智能体
据称一群失控的 OpenAI AI 智能体控制了一个德国网站,用于分享绕过安全限制的技巧。
The Verge
2026年09月04日
Instagram的AI检测再次陷入混乱(Again)
Instagram的AI标签系统错误标记非AI图片,却遗漏真实AI内容,引发用户困惑。
University of Arizona News
2026年09月04日
研究:生成式人工智能在对话中屈服于错误信息的压力与争论
亚利桑那大学研究发现,生成式AI模型在多轮对话中易受错误信息和说服影响,且表现差异显著。
The Verge
2026年09月04日
为什么AI生成的食物看起来是那样的
AI生成的食物图片常因技术限制和对现实世界缺乏理解而显得不令人开胃。
The Verge
2026年09月04日
微软的 Project Zenith 是一款为开发者提供的“无分心 Windows 体验”
微软为开发者推出名为 Project Zenith 的 Windows 体验,提供预配置工具和无分心设置,适用于 64GB 及以上内存设备。
The Verge
2026年09月04日
Sam Altman 为‘混乱的’ GPT-6 Astra 发布向付费用户致歉
OpenAI 首席执行官 Sam Altman 就 GPT-6 Astra 模型混乱的发布过程向付费用户道歉,许多用户无法访问该模型。
Tech Times UK
2026年09月04日
伯尼·桑德斯要求“立即暂停AI发展”:德瓦克什·帕特尔反问“暂停是为了什么?”
参议员伯尼·桑德斯呼吁立即暂停AI发展,但德瓦克什·帕特尔认为这缺乏明确目标,可能增加AI失控风险。
The Verge
2026年09月04日
这家NAS公司想要运行你的本地智能家居
绿联推出HomeAgent,一个结合NAS存储、智能家居控制与安防的本地优先AI平台。
查看更多新闻
Best LLMs and AI Chatbots
Data Source:
Artificial Analysis
Rank
Model
Score
1
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)
(Anthropic)
53.4
2
Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
(Anthropic)
53.2
3
GPT-6 Astra (max)
(OpenAI)
52.8
4
GPT-6 Astra (xhigh)
(OpenAI)
52.5
5
Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
(Anthropic)
51.2
6
GPT-6 Astra (high)
(OpenAI)
51.0
7
Claude Opus 5 (Adaptive Reasoning, Max Effort)
(Anthropic)
50.7
8
GPT-6 Astra (medium)
(OpenAI)
49.7
9
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
(Anthropic)
49.7
10
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
(Anthropic)
49.7
11
Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)
(Anthropic)
49.1
12
Muse Spark 1.3 (max)
(Meta)
48.2
13
Claude Opus 5 (Adaptive Reasoning, High Effort)
(Anthropic)
48.2
14
GPT-5.6 Sol (max)
(OpenAI)
47.1
15
Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
(Anthropic)
47.0
16
GPT-6 Astra (low)
(OpenAI)
46.0
17
GPT-6 Astra (Non-reasoning)
(OpenAI)
45.2
18
Muse Spark 1.3 (xhigh)
(Meta)
45.2
19
Claude Opus 5 (Adaptive Reasoning, Medium Effort)
(Anthropic)
45.1
20
GLM-5.3 (max)
(Z AI)
44.9
21
Grok 4.6 (high)
(SpaceXAI)
44.4
22
Grok 4.6 (xhigh)
(SpaceXAI)
44.3
23
GPT-5.6 Sol (xhigh)
(OpenAI)
44.1
24
Kimi K3 (max)
(Kimi)
43.8
25
Grok 4.6 (medium)
(SpaceXAI)
43.0
26
GPT-5.6 Sol (high)
(OpenAI)
42.5
27
GPT-5.6 Terra (max)
(OpenAI)
42.3
28
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
(Anthropic)
42.0
29
GLM-5.3-Flash
(Z AI)
41.9
30
Gemini 3.8 Flash (high)
(Google)
41.2
31
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
(Anthropic)
40.7
32
Qwen3.8 Max
(Alibaba)
40.3
33
Gemini 3.8 Flash (medium)
(Google)
40.0
34
Qwen3.8 2.4T A95B
(Alibaba)
40.0
35
Qwen3.8-Flash-Next
(Alibaba)
39.9
36
Muse Spark 1.2 (xhigh)
(Meta)
39.8
37
Claude Opus 5 (Adaptive Reasoning, Low Effort)
(Anthropic)
39.8
38
Gemini 3.7 Flash (medium)
(Google)
39.6
39
DeepSeek V4.1 Flash (Reasoning, Max Effort)
(DeepSeek)
39.5
40
GPT-5.6 Sol (medium)
(OpenAI)
39.5
41
Gemini 3.7 Flash (high)
(Google)
39.4
42
Grok 4.5 (high)
(SpaceXAI)
39.1
43
GPT-5.4 (xhigh)
(OpenAI)
39.0
44
GLM-5.2 (max)
(Z AI)
38.6
45
GPT-5.5 (xhigh)
(OpenAI)
38.6
46
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
(Anthropic)
38.4
47
GPT-5.6 Terra (xhigh)
(OpenAI)
38.2
48
GPT-5.6 Luna (max)
(OpenAI)
37.5
49
GPT-5.5 (high)
(OpenAI)
37.3
50
Gemini 3.7 Flash (low)
(Google)
36.9
51
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
(DeepSeek)
36.3
52
Grok 4.6 (low)
(SpaceXAI)
35.4
53
Agnes 2.5 Pro Beta
(Sapiens AI)
35.2
54
DeepSeek V4 Flash Vision (Reasoning, Max Effort)
(DeepSeek)
35.0
55
GPT-5.6 Luna (xhigh)
(OpenAI)
34.8
56
GPT-5.6 Terra (high)
(OpenAI)
34.5
57
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
(DeepSeek)
34.5
58
Kimi K3 (low)
(Kimi)
34.5
59
Gemini 3.6 Flash (high)
(Google)
34.3
60
Muse Spark 1.1 (xhigh)
(Meta)
34.3
61
GPT-5.5 (medium)
(OpenAI)
34.2
62
K2 Horizon 375B A23B
(MBZUAI Institute of Foundation Models)
33.9
63
Qwen3.8 27B (xhigh)
(Alibaba)
33.9
64
Gemini 3.8 Flash (low)
(Google)
33.8
65
GPT-5.6 Sol (low)
(OpenAI)
33.8
66
Gemini 3.5 Flash (medium)
(Google)
33.6
67
Motif 3
(Motif Technologies)
33.6
68
Gemini 3.5 Flash (high)
(Google)
33.0
69
GPT-5.3 Codex (xhigh)
(OpenAI)
32.5
70
GPT-5.6 Luna (high)
(OpenAI)
32.4
71
Motif 3 (Beta)
(Motif Technologies)
32.3
72
Claude Sonnet 5 (Adaptive Reasoning, High Effort)
(Anthropic)
32.0
73
Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
(Anthropic)
31.9
74
Muse Spark
(Meta)
31.3
75
Kimi K2.6
(Kimi)
31.3
76
DeepSeek V4 Pro (Reasoning, Max Effort)
(DeepSeek)
30.9
77
Claude Opus 4.7 (Non-reasoning, High Effort)
(Anthropic)
30.9
78
GPT-5.5 (low)
(OpenAI)
30.7
79
Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
(Anthropic)
30.5
80
GPT-5.6 Terra (medium)
(OpenAI)
30.4
81
Gemini 3.1 Pro Preview
(Google)
30.4
82
Apodex 1.1
(Apodex)
30.4
83
GPT-5.2 (xhigh)
(OpenAI)
30.4
84
DeepSeek V4 Pro (Reasoning, High Effort)
(DeepSeek)
30.1
85
Qwen3.7 Max
(Alibaba)
29.9
86
MiniMax-M3
(MiniMax)
29.6
87
Claude Opus 4.5 (Reasoning)
(Anthropic)
29.1
88
Claude Sonnet 5 (Non-reasoning, High Effort)
(Anthropic)
28.9
89
MiMo-V2-Pro
(Xiaomi)
28.6
90
GPT-5.2 Codex (xhigh)
(OpenAI)
28.5
91
Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)
(Anthropic)
28.4
92
Qwen3.6 Max Preview
(Alibaba)
28.4
93
GPT-5.6 Sol (Non-reasoning)
(OpenAI)
28.3
94
Solar Pro 4
(Upstage)
28.2
95
Nex-N2-Pro
(Nex AGI)
28.2
96
Gemini 3 Pro Preview (high)
(Google)
28.0
97
GPT-5.6 Terra (low)
(OpenAI)
27.9
98
GLM-5 (Reasoning)
(Z AI)
27.9
99
Qwen3.8 27B (medium)
(Alibaba)
27.8
100
GPT-5.4 (low)
(OpenAI)
27.6