SpaceXAI发布Grok Voice Transcribe 2.0,错误率降半
9月18日,SpaceXAI正式发布Grok Voice Transcribe 2.0语音转文本模型。该模型基于Grok Voice音频基础模型构建,错误率较1.0版降低约50%,定价维持不变: 批量转录0.10美元/小时,实时流式0.20美元/小时。模型在Artificial Analysis榜单32款流式模型中准确率排名第一,并在客服电话、日常对话、结构化信息(...
9月18日,SpaceXAI正式发布Grok Voice Transcribe 2.0语音转文本模型。该模型基于Grok Voice音频基础模型构建,错误率较1.0版降低约50%,定价维持不变: 批量转录0.10美元/小时,实时流式0.20美元/小时。模型在Artificial Analysis榜单32款流式模型中准确率排名第一,并在客服电话、日常对话、结构化信息(...
9月8日22: 32至9月9日05: 59(北京时间),OpenAI旗下ChatGPT和Images API的图像生成功能发生故障,持续7小时27分钟。故障导致用户提交图像生成请求时错误率显著升高,文件上传亦受影响--部分文件显示上传完成却无法访问,部分请求直接失败。OpenAI未公布具体技术原因、影响范围及恢复时间。此次中断波及全...
2026年8月27日,谷歌正式推出Gemini 3.5 Transcribe语音转文本模型。该模型专为优化语音输入体验设计,可实时过滤口头禅、自动修正口误,并支持85种语言及最多3人对话音频。目前已在Pixel 11的Gboard键盘"Rambler"功能中启用,后续将扩展至更多服务。相比前代Chirp 3,其转录速度提升约70%,实时错误率降至...
北京时间2026年8月17日21: 40起,GitHub平台发生大规模服务中断,Webhooks、Pull Request、Issue及Actions等核心功能受影响。UTC13: 45(即北京时间21: 45)起故障加剧,至22: 04错误率升至20%(API/网页),归档与原始仓库下载错误率达50%。Downdetector数据显示异常报告自当日9: 24起明显增多。GitHub官方...
2026年7月29日,OpenAI在X平台宣布推出GPT-Live-Transcribe与GPT-Transcribe两款语音转录模型,支持API调用。前者面向低延迟实时转录,后者适用于批量异步处理。两模型均提升上下文理解能力,显著改善多口音、多语言及高噪声环境下的转录准确率。GPT-Live-Transcribe定价0.017美元/分钟,GPT-Transcribe为...
7月15日,OpenAI官方状态页面显示,旗下聊天机器人ChatGPT目前正遭遇故障。页面公告指出,ChatGPT出现了"错误率升高"的情况。OpenAI正在对用户反映的登录问题以及影响该服务的间歇性错误展开调查。截至报告发布时,该故障已持续发生17分钟。
2026年7月,桥水基金AIA Labs联合Thinking Machines Lab测试GPT、Claude、Gemini等前沿大模型在六项基础金融信息筛选任务中的表现,平均准确率仅50%,优化后达70%,未达80%部署阈值。团队基于Qwen3-235B开源模型,通过Tinker平台微调,采用争议样本专家校正机制及多项训练优化技术,最终模型准确率达84.7%,...
2026年4月24日,阶跃星辰正式推出新一代自动语音识别模型StepAudio 2.5 ASR。该模型首次将大语言模型多Token预测(MTP)技术引入ASR领域,采用ASR+MTP-5融合架构,推理速度提升400%,时延降低60%,支持30分钟端到端长音频识别。在新闻、会议及噪声场景下综合错误率达业界SOTA水平。模型定价0.15元/小时,已上...
2026年4月,美国医学会期刊JAMA Network Open发布研究指出,当前21款主流大语言模型在临床早期鉴别诊断阶段错误率普遍超过80%。研究团队基于29个标准化病例,对GPT-5、Claude 4.5 Opus、Gemini 3、Grok 4等模型开展全流程评测,覆盖鉴别诊断、检查选择、最终诊断等五阶段。结果显示,模型在信息充分的后期...
2026年4月10日,外媒报道称,亚马逊正推进代号'Project Houdini'的数据中心模块化建设计划。该计划采用工厂预制的撬装模块(长13.7米、重约9吨),现场直接安装,使服务器部署时间从动工后15周缩短至2–3周,单座数据中心可节省最多5万工时。项目由亚马逊与Cupertino合作开发,目标2026年8月完成原型并规模化...
2026年4月2日,微软正式推出自研语音转录模型MAI-Transcribe-1。该模型在FLEURS基准测试(覆盖25种语言)中实现3.9%平均字错误率,宣称全球最精准。其在11种核心语言排名榜首,性能超越Whisper-large-v3及Gemini 3.1 Flash。转录速度达Azure Fast服务的2.5倍,定价仅0.36美元/小时,为当前主流云厂商中性价...
3月17日,《自然·神经科学》刊发研究称,科学家研发出一种新型脑机接口装置。该装置可实时解码瘫痪患者大脑中'尝试打字'的神经活动,并将其转化为准确文字。实验在多名运动皮层功能保留的瘫痪受试者中完成,平均输出速度达每分钟90字符,错误率低于5%。研究旨在为丧失语言与肢体能力者提供更自然、高效的...
2026年3月6日,OpenAI正式发布GPT-5.4系列模型,包括面向ChatGPT与API的GPT-5.4 Thinking版及面向复杂任务的GPT-5.4 Pro版。该模型首次整合前沿推理、编码与智能体能力,支持100万tokens上下文窗口,并具备原生计算机操作能力。其在专业任务基准中83%项目达行业专业水平,错误率较GPT-5.2下降18%。即日起...
2026年1月,Newsguard测试显示,Grok、ChatGPT和Gemini对Sora生成的伪造视频识别错误率分别达95%、92.5%和78%。研究使用20条经去水印处理的虚假视频,涵盖政治、航空等敏感场景。即便视频含可见水印或C2PA溯源元数据,三款模型仍频繁误判;ChatGPT更在7.5%带水印视频中仍失败,并多次否认元数据存在。Open...
6月10日,OpenAI正在对ChatGPT和Sora出现的错误率上升问题展开调查。据悉,这一情况可能影响到两款模型的使用体验,具体原因尚在分析中,OpenAI将尽快公布解决方案以优化用户服务。免责声明: 本文内容由开放的智能模型自动生成,仅供参考。
哥伦比亚大学数字新闻研究中心近期对八款AI搜索引擎进行了深入研究,包括ChatGPT Search、Perplexity及其付费版、Gemini、DeepSeek Search、Grok-2和Grok-3 Search以及Copilot。研究人员从20家新闻机构随机挑选了200篇报道,确保这些文章在谷歌搜索中排名靠前,随后用相同的查询方式测试各AI工具的准确...
今天微软官方宣布,与量子计算公司Quantinuum的深度合作取得了显著成果。在实验中成功完成了多达14000次无错误的量子计算操作,这一成就不仅刷新了量子计算错误率的纪录,而且将错误率降低了800倍,为量子计算的未来发展开辟了新的可能性。
太平洋标准时间11月23日上午6时31分,OpenAI更新运行情况说明称,ChatGPT的错误率升高,正在开展调查。
美国普渡大学的研究发现,OpenAI 开发的人工智能聊天机器人 ChatGPT 在回答软件编程问题时,错误率超过一半,且能骗过三分之一的提问者。该研究团队分析了 ChatGPT 对 517 个 Stack Overflow 网站上的问题的回答,评估了其正确性、一致性、全面性和简洁性。他们还对回答进行了语言和情感分析,并对 12 名...
人工智能研究机构OpenAI表示,已针对生成式AI技术ChatGPT的错误率上升进行了修复。OpenAI在网站上表示,已针对ChatGPT和GPT-4错误率上升进行了修复。OpenAI正在安全地启用GPT-4和GPT-3.5Turbo的精细调整功能,并预计该功能将在今年晚些时候可用。