成为VIP会员查看完整内容
VIP会员码认证
首页
主题
会员
服务
注册
·
登录
GPT-4o
关注
1
GPT-4o(“o”代表“omni”)朝着更自然的人机交互迈出了一步——它可以接受任何组合的文本、音频和图像作为输入,并生成任何组合的文本、音频和图像输出。它对音频输入的响应时间最短可达232毫秒,平均为320毫秒,这与人类在对话中的响应时间相似。在英语文本和代码处理上,它的性能与GPT-4 Turbo相当,但在非英语文本处理方面有显著改进,同时在API中速度更快且成本降低50%。与现有模型相比,GPT-4o在视觉和音频理解方面尤其出色。
综合
百科
VIP
热门
动态
论文
精华
MedAgent-R1: Faithfulness-Aware Reinforcement Learning for Evidence-Grounded Medical Reasoning
Arxiv
0+阅读 · 8月31日
Measuring the Tokenization Premium: A Cost Audit for Underserved Language Communities
Arxiv
0+阅读 · 8月10日
Benchmarking Retrieval-Augmented Generation Strategies for Large Language Model-Based Travel Mode Choice Prediction
Arxiv
0+阅读 · 8月24日
Retroactive Chain-of-Thought (RetroCoT): Forensic Reconstruction Prompts as a Safety Diagnostic Across Model Generations
Arxiv
0+阅读 · 7月6日
Faithful by Design: Evaluating and Improving LLM-Generated Clinical Trial Summaries for Multi-Stakeholder Audiences
Arxiv
0+阅读 · 7月10日
Can AI Debias the News? LLM Interventions Improve Cross-Partisan Receptivity but LLMs Overestimate Their Own Effectiveness
Arxiv
0+阅读 · 7月24日
Prompt Structure Redistributes, Not Reduces: An Empirical Analysis of Security-Weaknesses in LLM-Generated Python Code
Arxiv
0+阅读 · 8月25日
Benchmarking Commercial Speech Recognition and Multimodal Large Language Models on Dysarthric Speech: Severity-Stratified Baselines and Architecture-Specific Prompting Effects
Arxiv
0+阅读 · 8月20日
Zero-Shot Vision-Language Models for Classroom Engagement Recognition: A Benchmark Study of Prompt Sensitivity and Cross-Dataset Generalization
Arxiv
0+阅读 · 6月20日
Evaluating Large Language Models for Hausa and Fongbe Machine Translation: Benchmarks, Failures, and Metric Reliability
Arxiv
0+阅读 · 6月20日
MultiZebraLogic: A Multilingual Logical Reasoning Benchmark
Arxiv
0+阅读 · 6月22日
An Exploratory Case Study of LLM-Assisted Refactoring and Gameplay Feature Generation in an Endless Runner Game
Arxiv
0+阅读 · 6月19日
Gender Bias in LLM Hiring Decisions: Evidence from a Japanese Context and Evaluation of Mitigation Strategies
Arxiv
0+阅读 · 6月17日
3D-PLOT-LLM: Part-Level Object Tokens for 3D Large Language Models
Arxiv
0+阅读 · 6月18日
Binary Tracking for Spatial QA and Navigation with Open Vision-Language Models
Arxiv
0+阅读 · 6月15日
参考链接
https://openai.com/index/hello-gpt-4o/
提示
微信扫码
咨询专知VIP会员与技术项目合作
(加微信请备注: "专知")
微信扫码咨询专知VIP会员
Top