大模型智能|分享 来源 | 新智元
基本电脑操作
我的朋友要来旧金山,我想明天早上和他一起在金门大桥看日出。我们将从太平洋高地出发。你能帮我们找到一个绝佳的观赏地点,查看一下开车时间和日出时间,然后安排一个日历活动,让我们有足够的时间到达那里吗?
自动编码写网站
自动寻找数据填表
远低于人类,但未来可期
在零售领域的得分从62.6%提高到69.2%,在更具挑战性的航空领域则从36.0%跃升至46.0%。
GitLab:在DevSecOps任务测试中,发现Claude 3.5 Sonnet在不增加延迟的前提下,推理能力显著提升(各用例最高提升10%),使其成为驱动复杂软件开发流程的理想选择 Cognition:将新版Claude 3.5 Sonnet应用于自主AI评估,在编码、规划和问题解决等方面,相较前代模型均取得了实质性进步 The Browser Company:在使用该模型自动化网络工作流程时发现,Claude 3.5 Sonnet的表现超越了他们此前测试过的所有模型