Navigate to WaytoAGI Wiki →
Home/Question List/Question Detail

openai发布会要点

Answer

以下是 OpenAI 发布会的要点:

  1. 技术进步展示:从 GPT 4o 到 11 的技术跳跃,在数学竞赛 GPQA 中有出色表现。
  2. 原始智能与编码性能:强调原始智能在编码性能方面的重要性,这是用户使用模型的主要领域。
  3. 多模态处理能力:展示了模型处理困难问题和多模态输入的能力。
  4. 新产品发布:推出聊天 GBT 专业版,提供无限制模型访问和高级语音模式;介绍 O one 亲模式,称其为世界上最智能的机型之一。
  5. 性能提升:通过比较专业模式和普通模式,展示了在可靠性和性能上的提升。
  6. 用户反馈与改进:根据用户反馈改进 O one 预览版,使其更快更智能,增加多模态输入功能,允许通过图像和文字进行联合推理。
  7. Chat BT Pro 和 O one Pro 模式:Chat BT Pro 允许无限制访问最佳模型,如 O14,并提供 O one Pro 模式处理最困难的问题。
  8. 错误率和速度提升:新模型的错误率比 O one 预览版少 34%,思考速度提高 50%。
  9. 多模态推理演示:通过太空数据中心的案例展示多模态推理。
  10. Chat BT Pro 的扩展功能:正在为其添加网页浏览、文件上传等更多功能。

此外,在 12 月 12 日和 12 月 15 日的宝玉日报中,提到 OpenAI 连续 12 天 AI 发布会的第五天亮点功能包括苹果设备深度集成 ChatGPT,可通过 Siri 实现文档总结、任务分配、节日创意等操作;多平台无缝衔接,支持 iPhone、iPad 和 Mac,涵盖多种应用场景;实用场景包括圣诞派对策划、PDF 总结、歌单生成、视觉智能评选毛衣创意等功能演示,体现全新交互体验。相关链接:https://x.com/dotey/status/1866974269051113543

Content generated by AI large model, please carefully verify (powered by aily)

References

OpenAI12场发布会每日记录-Day1-7

1.技术进步展示:展示了从GPT 4o到11的技术跳跃,特别是在数学竞赛GPQA中的表现。2.原始智能与编码性能:强调了原始智能在编码性能方面的重要性,这是用户使用模型的主要领域。3.多模态处理能力:展示了模型如何处理困难问题和多模态输入。4.新产品发布:推出了聊天GBT专业版,提供无限制模型访问和高级语音模式。介绍了O one亲模式,这是目前世界上最智能的机型之一。5.性能提升:通过比较专业模式和普通模式,展示了在可靠性和性能上的提升。6.用户反馈与改进:根据用户反馈,改进了O one预览版,使其更快更智能。增加了多模态输入功能,允许通过图像和文字进行联合推理。7.Chat BT Pro和O one Pro模式:Chat BT Pro允许无限制访问最佳模型,如O14,并提供O one Pro模式,用于处理最困难的问题。8.错误率和速度提升:经过人类评估,新模型的错误率比O one预览版少了34%,思考速度提高了50%。9.多模态推理演示:通过一个太空数据中心的案例,展示了模型如何进行多模态推理。10.Chat BT Pro的扩展功能:正在为Chat BT Pro添加更多功能,如网页浏览、文件上传等。

宝玉 日报

?宝玉日报「12月12日」✨✨✨✨✨✨✨✨?OpenAI连续12天AI发布会:第五天完整视频(中英文双语字幕)亮点功能:苹果设备深度集成ChatGPT,可通过Siri实现文档总结、任务分配、节日创意等操作。多平台无缝衔接:支持iPhone、iPad和Mac,涵盖Siri集成、写作工具增强、视觉智能分析等多种应用场景。实用场景:圣诞派对策划、PDF总结、歌单生成、视觉智能评选毛衣创意等功能演示,体现全新交互体验。?[https://x.com/dotey/status/1866974269051113543](https://x.com/dotey/status/1866974269051113543)

宝玉 日报

?宝玉日报「12月14日」✨✨✨✨✨✨✨✨?OpenAI连续12天AI发布会:第五天完整视频(中英文双语字幕)亮点功能:苹果设备深度集成ChatGPT,可通过Siri实现文档总结、任务分配、节日创意等操作。多平台无缝衔接:支持iPhone、iPad和Mac,涵盖Siri集成、写作工具增强、视觉智能分析等多种应用场景。实用场景:圣诞派对策划、PDF总结、歌单生成、视觉智能评选毛衣创意等功能演示,体现全新交互体验。?[https://x.com/dotey/status/1866974269051113543](https://x.com/dotey/status/1866974269051113543)

Others are asking
OpenAI Operator, Anthropic Claude Coder
以下是关于 OpenAI Operator 和 Anthropic Claude Coder 的相关信息: 2025 年 Agent 领域的发展预测: 从对话助手到行动型智能体是 2025 年 Agent 技术的主流发展方向之一。计算机操作能力取得突破,传统大模型更多充当聊天助手,而 2025 年的突破在于让 Agent 直接“动手”操作电脑和网络环境。 Anthropic 在 2024 年底发布的 Claude 3.5 Sonnet 首次引入“Computer Use”能力,让 AI 像人一样通过视觉感知屏幕并操作鼠标键盘,实现了 AI 自主使用电脑的雏形。 OpenAI 在同期推出了代号“Operator”的 Agent 及其核心模型“计算机使用智能体”(CUA),使 GPT4 获得直接与图形界面交互的能力。CUA 通过强化学习将 GPT4 的视觉能力与高级推理相结合,训练 AI 可像人一样点击按钮、填表、滚动页面等。在 OpenAI 的测试中,CUA 在浏览器任务基准 WebArena 和 WebVoyager 上分别达到 38.1%和 87%的成功率,后者已接近人类水平。 其他相关信息: 宝玉日报 1 月 25 日: Deepseek 提示词框架包含四大模块:任务目的(Purpose)、计划规则(Planning Rules)、格式规则(Format Rules)、输出说明(Output)。 Anthropic 的 Claude 可通过屏幕截图获取计算机视觉信息,计算光标移动的像素坐标,并执行点击、滚动等操作。 OpenAI Operator 利用虚拟主机和 Chrome 浏览器,通过 CUA 实现网页实时操作,支持复杂任务导航。 主要的大语言模型: OpenAI 系统包括 3.5 和 4 等,3.5 模型在 11 月启动了当前的 AI 热潮,4.0 模型在春季首次发布,功能更强大。新的变种使用插件连接到互联网和其他应用程序。Code Interpreter 是一个非常强大的 ChatGPT 版本,可以运行 Python 程序。未为 OpenAI 付费只能使用 3.5。微软的 Bing 使用 4 和 3.5 的混合,通常是 GPT4 家族中首个推出新功能的模型,连接到互联网。 谷歌一直在测试自己的人工智能 Bard,由各种基础模型驱动,最近是 PaLM 2 模型。 Anthropic 发布了 Claude 2,其最值得注意的是有一个非常大的上下文窗口。
2025-04-01
openai官方文档
以下是关于 OpenAI 官方文档的相关信息: 对于刚入门学习提示词的朋友,建议先有一个大模型帐号并熟悉与之对话的方式。推荐的国产平替有 。 学习 prompt 必须看 OpenAI 的官方文档,相关链接有: 。 在 OpenAI 官方的说明文档(Documentation)中,为用户提供了若干项策略以帮助更好地使用 ChatGPT。例如策略一:编写清晰的说明,即在询问中包含详细信息以获得更多相关答复。因为大模型无法在有限信息中“猜测”用户意图,所以提问时不要惜字如金,多说一些内容、多提供一些信息能有效提高回复的质量和丰富性。文中还列举了多个例子进行说明。
2025-03-29
OpenAI o1、Claude Sonnet 3.7、Gemini 2.0 pro 哪个 AI 搜索能力更强?
OpenAI o1、Claude Sonnet 3.7 和 Gemini 2.0 pro 在不同方面具有各自的优势,难以简单地比较哪个的搜索能力更强。 OpenAI o1 推理能力强,适合作为架构师或算法顾问。 Claude Sonnet 3.7 擅长长上下文任务,在快速生成代码与网页设计方面表现出色。 Gemini 2.0 pro 长上下文支持较好(2M Tokens),适合代码反编译与混淆代码分析。 具体的搜索能力表现还会受到应用场景和具体任务的影响。
2025-03-21
openai deep research使用技巧
OpenAI 的 Deep Research 功能能够整合多源信息,进行复杂的信息查询与分析,并生成专业水准的报告,同时详细展示思考和搜索过程。目前,该功能仅支持文本输出,未来还将增加嵌入式图片、数据可视化等功能。使用入口为在 ChatGPT 输入框中选择「Deep Research」模式,输入问题后即可开始体验。 在 OpenAI 推出「Deep Research」功能一天后,Hugging Face 的工程师迅速联合推出了免费开源的版本 Open Deep Research,能自主浏览网页、滚动页面、处理文件,以及基于数据进行计算。使用入口为前往 Demo 网站(opendeepresearch.vercel.app)体验。 Deep Research 让 AI 自动完成多步骤研究任务,快速分析海量信息并生成专业报告,具备自动化信息汇总、文献引用与多领域适用性,适合科研、工程、金融等行业。目前向 Pro 用户开放,未来将扩展至 Plus 和 Team 用户,并提供更强大的功能。 该智能体基于优化版 OpenAI o3 模型,结合网络浏览和 Python 分析能力,实现高效研究,适用于科学、政策、工程等高强度知识工作,也能帮助购物者做复杂决策。Pro 用户已可使用,后续将逐步向 Plus、Team 和企业用户开放。
2025-03-08
openAI的deep research有哪些缺陷
OpenAI 的 Deep Research 存在以下一些缺陷: 1. 具有滞后性,在某些信息上无法做到及时更新。 2. 存在信息混乱的问题,无法完全替代人类的深度思考。
2025-03-03
Monica和Openai的记忆功能是如何让大模型产生记忆的?是什么原理?
大模型的记忆功能实现方式较为复杂,不同的模型可能有所不同。 OpenAI 的模型中,大模型 LLM 扮演了“大脑”的角色,其记忆功能可能通过“Agent = LLM + 规划 + 记忆 + 工具使用”的基础架构来实现。但需要注意的是,对于 ChatGPT 这类模型,实际上其本质上并没有直接的记忆功能。它能理解之前的交流内容,是因为每次将之前的对话内容作为新的输入重新提供给模型。这种记忆功能并非由大型模型直接实现,而是通过在别处进行存储来达成。 如果对话内容过长,可能会影响模型的整体性能。解决这个问题的一个简单方法是启动另一个对话框。对于之前的数据,通常只能进行总结。
2025-03-01
哪个AI可以帮我看视频并总结要点?
以下是一些可以帮助您看视频并总结要点的 AI 工具和方法: 1. GPT 系列:您可以将视频的字幕提取出来,全选复制发送给 GPT 进行总结。例如对于 B 站视频,如果其有字幕,您可以通过安装油猴脚本获取字幕,然后复制发送给 GPT 进行总结。GPT4 能识别重点内容。 2. BibiGPT:https://bibigpt.co/ 它可以支持小红书、B 站等网站视频的归纳总结,还可以提问互动,答案会附上对应的视频节点,是融合课程备课的好助手。 此外,还有以下相关的经验分享: 1. 即刻用户拐子狼分享的用 AI 做播客笔记的工作流:用飞书妙计将音频转换为文字;找不到合适的封面图时,使用 Midjourney 制作;Raycast AI 初步检索关键词;Notion AI 总结全文内容。 2. 张翼然的“AI 引领未来课堂的探索与实践.pdf”中提到的优化线上课程、总结内容和知识点的方法,以及推荐的其它视频工具如剪映的图文成片功能(只需提供文案,自动配图配音)。
2025-02-10
Maimo:能从任何内容中提取要点
Maimo 是一种能够从各种内容来源(如电话记录、财务报告和网页)中提取关键要点的工具。它具有以下特点: 1. 简化提取要点的过程,消除手动文本扫描和笔记结构化的需要。 2. 用户可提出问题并立即获得答案。 3. 提供全球问答功能,无需特定关键词即可检索信息。 4. 与日常应用程序集成,增强在用户工作流程中的生产力和易用性。 相关链接:https://maimo.ai/
2025-01-01
open发布会要点
以下是 OpenAI 发布会的要点: 1. 技术进步展示:从 GPT 4o 到 11 的技术跳跃,在数学竞赛 GPQA 中有出色表现。 2. 原始智能与编码性能:强调原始智能在编码性能方面的重要性,这是用户使用模型的主要领域。 3. 多模态处理能力:展示了模型处理困难问题和多模态输入的能力。 4. 新产品发布:推出聊天 GBT 专业版,提供无限制模型访问和高级语音模式;介绍 O one 亲模式,是目前世界上最智能的机型之一。 5. 性能提升:通过比较专业模式和普通模式,展示了在可靠性和性能上的提升。 6. 用户反馈与改进:根据用户反馈改进 O one 预览版,使其更快更智能,增加多模态输入功能,允许通过图像和文字进行联合推理。 7. Chat BT Pro 和 O one Pro 模式:Chat BT Pro 允许无限制访问最佳模型,如 O14,并提供 O one Pro 模式处理最困难的问题。 8. 错误率和速度提升:新模型的错误率比 O one 预览版少 34%,思考速度提高 50%。 9. 多模态推理演示:通过太空数据中心的案例展示模型的多模态推理能力。 10. Chat BT Pro 的扩展功能:正在为其添加网页浏览、文件上传等功能。 新模型 9.12 发布的要点: 1. 发布两个模型:o1 mini,o1 preview。Plus 全量可用 o1 mini 一周 50 条,o1 preview 一周 30 条。 2. 更聪明的思考方式:像人一样花更多时间思考问题,尝试不同策略,能意识到自己的错误。 3. 在复杂任务上表现出色:在物理、化学、生物、数学和编程等领域的挑战性任务上表现得像博士生,在 IMO 和 Codeforces 竞赛中取得高分。 4. 暂时缺少一些功能:目前没有 ChatGPT 那样的网络浏览和文件上传功能,但在复杂推理任务上非常强大。 O1 Pro 版本的要点: 1. 面向专业用户,强大精确。 2. 独有功能包括深度推理能力,可处理复杂数学和科学问题,支持多步推理和专业计算,思考时间约 1 3 分钟;在科学、数学、编程等领域表现出色,提供专业准确解答;支持长文本处理,轻松应对长文档处理与内容生成;提供更多微调选项,用户可根据自身需求进行个性化定制。 3. 对比优势:错误率大幅降低,推理能力显著增强,基准测试表现惊人。 ChatGPT Pro 订阅计划的要点: 1. 费用为每月 200 美元。 2. 目标用户是解决复杂问题的研究人员、工程师和专业人士。 3. 核心功能是使用 o1 Pro 模式,专为数学竞赛、科学研究、代码开发等高要求场景优化,提供更高的准确性和可靠性,适用于严格的技术基准测试任务。 4. 特别支持:OpenAI 为美国医学研究人员提供资助,重点支持罕见病基因发现、痴呆症研究、癌症免疫治疗。 发布会吐槽:直播仅用 30 分钟讲完,像是把一个大更新硬切成了 12 段。总结:o1 基础版主打日常体验,速度快且功能全面;o1 Pro 版深度推理与专业能力爆表,适合更复杂的任务。ChatGPT Pro 订阅计划开启了高性能 AI 工具的新篇章,推动科研与工程领域的新突破!
2024-12-17
如果要设计一个对话式的AI用户界面,有哪些要点需要注意?
设计一个对话式的 AI 用户界面,以下要点需要注意: 1. 语言使用: 使用用户熟悉的词语、短语和概念,避免内部术语。 遵循现实世界的惯例,使信息呈现自然和逻辑的顺序。 确保用户能够理解单词的含义,无需查阅字典。 永远不要假设自己对单词或概念的理解与用户匹配,通过用户研究揭示用户熟悉的术语和他们对重要概念的心智模型。 2. 行为引导: 明确告诉 API 意图以及如何行事,避免其偏离轨道。 给 API 赋予一个身份,有助于其以接近真相的方式进行回答。 提供问题和答案示例,让 API 掌握回复模式。 3. 编程方式: 从命令式编程转变为对话式编程,与 AI 进行深度互动,讨论需求而非直接命令。 利用 AI 从想法到实现的全程协助,但初学者需谨慎使用,避免过度依赖导致基础知识缺失,应将其作为学习工具。
2024-12-12
我是一个老师,相信AI时代人人都能成为学霸,我认为学霸具有三个心法和一个方法,方法一,建立学霸的信念系统(我行、我能、我可以),方法二,不要和别人比,方法三、主动积极的思考力。学霸的终极方法是自学。自学+AI无所不能。你觉得我怎么能帮助每一个学生成为学霸,有哪些步骤和要点?
在 AI 时代帮助每个学生成为学霸,以下是一些步骤和要点: 1. 培养获取知识的能力:教导学生掌握利用 AI 技术获取和处理信息的方法,提高获取知识的效率。 2. 促进知识内化:引导学生将获取的信息和知识有效内化,转化为智慧。例如,通过实践反思、交流讨论等方式,提升知识的转化速度和质量。 3. 建立信念系统:帮助学生树立“我行、我能、我可以”的信念,增强学习的自信心。 4. 培养独立思考:鼓励学生主动积极思考,不盲目与他人比较,专注自身的成长和进步。 5. 强调自学:引导学生重视自学,让他们明白自学结合 AI 能够带来强大的能力。 6. 培养创造能力: 鼓励学生勇于尝试新事物,将失败视为学习的一部分。 培养批判性思维,不盲目跟从权威。 引导学生从实践中反思,提炼洞见。 促进学生与不同背景的人交流,激发新的思路。 持续学习和不断创造是相辅相成的,通过积累知识和经验,并将其转化为实际价值,学生能够在 AI 时代更好地成长和发展。
2024-10-08
请输出人工智能通识课的50个知识要点
很抱歉,暂时没有关于人工智能通识课的 50 个知识要点的相关内容。但以下为您提供一些常见的人工智能知识要点作为参考: 1. 人工智能的定义和发展历程 2. 机器学习的基本概念和方法 3. 深度学习的原理和应用 4. 神经网络的结构和工作机制 5. 监督学习、无监督学习和强化学习 6. 数据预处理和特征工程 7. 模型评估指标和方法 8. 常见的机器学习算法,如决策树、随机森林、支持向量机等 9. 自然语言处理的基本任务和技术 10. 计算机视觉的应用和算法 11. 语音识别和合成的原理 12. 智能推荐系统的工作原理 13. 人工智能在医疗、金融、交通等领域的应用 14. 伦理和社会问题,如算法偏见、数据隐私等 15. 人工智能的局限性和挑战 16. 知识表示和推理 17. 遗传算法和进化计算 18. 模糊逻辑和不确定性处理 19. 人工智能与人类智能的比较 20. 智能机器人的发展和应用 21. 自动驾驶技术的原理和挑战 22. 情感计算和情感分析 23. 图像分类和目标检测 24. 文本分类和情感分类 25. 命名实体识别和信息抽取 26. 关系抽取和知识图谱 27. 机器翻译的方法和技术 28. 问答系统的设计和实现 29. 语音情感识别 30. 图像生成和风格迁移 31. 文本生成和摘要提取 32. 强化学习中的策略优化 33. 深度强化学习在游戏中的应用 34. 人工智能的硬件支持,如 GPU 加速 35. 分布式机器学习和云计算 36. 模型压缩和量化 37. 迁移学习和领域自适应 38. 半监督学习和弱监督学习 39. 异常检测和故障诊断 40. 时间序列预测和分析 41. 多模态数据融合 42. 人工智能的安全和防护 43. 可解释性人工智能 44. 对抗生成网络的原理和应用 45. 胶囊网络和注意力机制 46. 图神经网络和社交网络分析 47. 预训练语言模型,如 GPT、ELMO 等 48. 人工智能的开源框架和工具 49. 人工智能的教育和培训 50. 未来人工智能的发展趋势和展望
2024-09-12
grok3 发布会亮点内容
Grok 3 发布会的亮点内容包括: 1. 包含两个模型版本:Grok 3 和 Grok 3mini。 2. 在 AIME 和 GPQA 在内的基准测试中显著优于其他模型,在数学推理、代码处理、科学问题方面表现优秀。 3. 具备推理能力,在提供更多测试计算时间的情况下,优于 o1 和 R1。 4. 今天向所有 Premium+订阅者推出(IOS、网页版都有),完整版在网页版,APP 上的 Grok 3 有一定削弱。 5. 新增“Deep Search”能力,能深入了解用户目的,访问并交叉验证多个信息源,确保研究内容准确,并公开执行搜索步骤。 6. 可以调用 Big Brain 功能加强计算来解决问题。 7. 现场演示中,Grok 3 可以生成游戏设计方案。 8. Grok 3 语音模式在大约一周内推出。 9. Grok 3 API 几周后推出。 10. Grok 2 将在 Grok 3 正式可用后开源,xAI 计划也会开源 Grok 3。
2025-02-19
OpenAI过去12天的发布会总结
以下是 OpenAI 过去 12 天发布会的总结: 自媒体记录方面: 夕小瑶科技说:o3 发布,可能影响码农工作。 孔某人的低维认知:OpenAI 圣诞 12 天总评,感谢大佬赏饭。 MAX 01Founder:一文详解 o3,虽接近 AGI 但使用成本高。 南瓜博士:使用 o3 钱包和脑子可能不够。 数字生命卡兹克:OpenAI 正式发布 o3,通往 AGI 路上已无障碍。 具体发布内容: Day12:o3 与 o3 mini 正式亮相。 Day11:ChatGPT 桌面应用,Option+空格快速唤起。 Day10:OpenAI 发布电话倾诉功能 18002428478。 Day9:o1 满血版 API 和 4o 实时语音 API 更新。 Day8:AI 搜索功能免费开放,并支持实时语音搜索。 Day7:ChatGPT 全新“项目”功能发布。 Day6:实时视频通话&圣诞老人模式正式上线。 Day5:ChatGPT 与 Apple 的深度合作。 Day4:直播“翻车”的 Canvas。 Day3:Sora 终于上线,有案例和功能详解。 Day2:微调 O1 模型,低成本高效率。 Day1:强化学习微调的实操案例。 宝玉日报 12 月 18 日: AI 架构与技术选型的 4 条原则:选主流框架、确保测试覆盖率、避免私有框架、采用模块化设计。 OpenAI 12 天发布会第 9 天:o1 API 正式版速度更快成本降低,支持多种新功能;语音交互升级,引入 WebRTC 支持,处理费用降低;新增偏好微调功能和工具包,简化 API 密钥申请流程。 易观分析报告预测了 AI 技术未来的关键发展方向,德邦证券报告对 OpenAI 十二日发布会进行深度总结,认为随着大模型能力提升和应用场景扩展,AI 应用商业价值有望实现,建议关注相关领域。
2024-12-31
openai发布会内容
以下是关于 OpenAI 发布会的相关内容: 1. 12 月 20 日,OpenAI 发布 AI 大模型风险防范框架文件,OpenAI 董事会有权决定发布新 AI 模型,框架文件提出防范 AI 大模型灾难性风险的路线图,董事会可推翻领导团队关于 AI 模型发布的决策。相关链接:https://openai.com/safety/preparedness 2. 12 月 12 日,OpenAI 连续 12 天 AI 发布会的第五天完整视频(中英文双语字幕),亮点功能包括苹果设备深度集成 ChatGPT,可通过 Siri 实现文档总结、任务分配、节日创意等操作,多平台无缝衔接,涵盖多种应用场景,实用场景包括圣诞派对策划、PDF 总结、歌单生成、视觉智能评选毛衣创意等功能演示,体现全新交互体验。相关链接: 3. OpenAI 将在 11 月 6 日举办首次开发者大会,会上将发布重要更新,目标是让开发者能够更快捷和廉价地开发基于大模型的应用。此次更新最让人期待的部分是将推出 Stateful API,理论上可将大模型应用的开销削减为原来的二十分之一。相关链接:https://mp.weixin.qq.com/s/NPqAeSl3NQ0_wbHzsJSw
2024-12-19
OpenAI前六场发布会的内容提炼
以下是 OpenAI 前六场发布会的部分内容提炼: OpenAI 第六天发布会:ChatGPT 的高级语音模式获得公开访问权限,能通过自然语音与用户对话并理解屏幕内容,降低使用门槛,展示多模态能力和个性化发展潜力。 相关报告:甲子光年发布的《2024 人工智能产业 30 条判断——万千流变,一如既往》涵盖 AI 技术历史发展、当前趋势和未来预测,提到 Transformer 模型和 GPT 系列发展及在多行业应用,探讨了 AI 芯片进步、在科学研究中的角色和对社会的广泛影响,还预测了 AI 产业增长。中信建投证券的海外 AI 应用行业专题《旧金山草根调研与海外 AI 应用进展》长达 100 多页,聚焦旧金山草根调研及海外 AI 应用进展,显示旧金山及硅谷地区 AI 企业众多,AI 应用在 To B 场景如广告、助手、数据分析等领域受关注,长期看好,尤其是 C 端应用潜力,列举了多家公司及其业务领域、功能进展,并提供相关上市公司数据。 OpenAI 首届开发者大会:短短 45 分钟发布会,Sam Altman 表示团队对开发者关注的问题做了六大升级,包括更长的上下文长度、更强的控制、模型的知识升级、多模态、模型微调定制和更高的速率限制,前四条主要关于新模型性能提升,后两点针对企业开发者痛点,同时宣布 API 价格下调。
2024-12-17
OPenAI最近的产品发布会
OpenAI 近期举行了多次产品发布会: 去年 11 月晚些时候发布了基于 GPT3.5 最新版本的消费级产品 ChatGPT。公司内部对是否发布这样强大的工具存在争论,但 Altman 表示支持,认为这是让公众适应 AI 改变日常生活现实的战略一部分。ChatGPT 功能强大,能在 SAT 考试中获大学水平分数、写作文、总结书籍等,还能按各种要求改写。 近期举行了 12 场发布会,推出多个新产品,包括推理模型 o1、文字转视频工具 Sora 等。o1 正式版在复杂推理和数学能力上显著提升,推出的强化微调技术使模型更具专业性。 在 5 月份的 GPT4o 模型发布会上,邀请了可汗学院的创始人 Salman Khan 和他儿子一起使用 GPT4o 辅导孩子在可汗学院上做数学题,这是 OpenAI 第一次将多模态模型能力在教育场景上落地应用的尝试。
2024-12-17